
gpt-6-luna
OpenAI 推出的轻量级大模型
2026-09-23
缓存写入:
$0.125/1M tokens起
缓存读取:
$0.01/1M tokens起
输入:
$0.1/1M tokens起
输出:
$0.5/1M tokens起
大额采购联系客户经理享专属优惠
API介绍
GPT-6 Luna 是 OpenAI 专为毫秒级超低延迟、高并发推理及极高性价比需求打造的极致轻量级大模型。作为 GPT-6 家族中的速度与吞吐担当,Luna 在延续 GPT-6 世代优秀指令遵循与结构化输出能力的同时,将响应延迟与 Token 算力成本压缩到了极致。模型支持自适应 Thinking/Reasoning 机制,在面对日常客服分流、高频数据解析、意图识别及轻量级代码生成等高并发场景时,能够提供极快且保质的输出,是取代前代 Flash/Mini 级模型、规模化压低企业 AI 运营成本的理想选择。
───────────────────────────────────────────────────────────────────
核心能力
极致响应速度与高吞吐: 首字延迟(TTFT)极低,端到端生成速度大幅提升,专为高并发 API 接入与实时交互系统优化。
自适应思考与轻量推理: 原生支持轻量思考机制,可根据任务难度开启 low 或 medium 推理力度,在复杂规则判断与轻量逻辑求解中大幅降低误判率。
1M 超长上下文与无感缓存: 默认支持 1,000,000 (1M) Tokens 超长上下文窗口,完美兼容大型文档分析、多轮历史对话与高频结构化数据(JSON)提取。
极致冰点定价: API 调用成本仅为旗舰 Astra 的几十分之一,输入低至 $0.20 / 1M,大幅降低大规模应用部署的隐性成本。
Playground
登录后,探索更多精彩功能! 点击登录
API统计
API列表 (5)
API价格表
$¥ 円 ₽