gpt-6-luna

gpt-6-luna

OpenAI 推出的轻量级大模型
2026-09-23
语言大模型
Model capability: imageModel capability: videoModel capability: thinkingModel capability: function_call
缓存写入:
$0.125/1M tokens
缓存读取:
$0.01/1M tokens
输入:
$0.1/1M tokens
输出:
$0.5/1M tokens
大额采购联系客户经理享专属优惠

API介绍

GPT-6 Luna 是 OpenAI 专为毫秒级超低延迟、高并发推理及极高性价比需求打造的极致轻量级大模型。作为 GPT-6 家族中的速度与吞吐担当,Luna 在延续 GPT-6 世代优秀指令遵循与结构化输出能力的同时,将响应延迟与 Token 算力成本压缩到了极致。模型支持自适应 Thinking/Reasoning 机制,在面对日常客服分流、高频数据解析、意图识别及轻量级代码生成等高并发场景时,能够提供极快且保质的输出,是取代前代 Flash/Mini 级模型、规模化压低企业 AI 运营成本的理想选择。

───────────────────────────────────────────────────────────────────

核心能力

极致响应速度与高吞吐: 首字延迟(TTFT)极低,端到端生成速度大幅提升,专为高并发 API 接入与实时交互系统优化。

自适应思考与轻量推理: 原生支持轻量思考机制,可根据任务难度开启 lowmedium 推理力度,在复杂规则判断与轻量逻辑求解中大幅降低误判率。

1M 超长上下文与无感缓存: 默认支持 1,000,000 (1M) Tokens 超长上下文窗口,完美兼容大型文档分析、多轮历史对话与高频结构化数据(JSON)提取。

极致冰点定价: API 调用成本仅为旗舰 Astra 的几十分之一,输入低至 $0.20 / 1M,大幅降低大规模应用部署的隐性成本。

Playground

登录后,探索更多精彩功能! 点击登录

API统计

API列表 (5)

API描述接口地址请求方法稳定性参数说明
Chat(聊天)
POST
稳定
查看详情
Chat(分析图片)
POST
稳定
查看详情
Chat(结构化输出)
POST
稳定
查看详情
Chat(函数调用)
POST
稳定
查看详情
Responses(聊天)
POST
稳定
查看详情

API价格表

$
模型说明上下文官网原价302.AI价格官网价差

gpt-6-luna

≤ 272K
272000

缓存写入$0.125 / 1M tokens
缓存读取$0.01 / 1M tokens
输入$0.1 / 1M tokens
输出$0.5 / 1M tokens

缓存写入$0.125 / 1M tokens
缓存读取$0.01 / 1M tokens
输入$0.1 / 1M tokens
输出$0.5 / 1M tokens

原价

gpt-6-luna

> 272K
1050000

缓存写入$0.25 / 1M tokens
缓存读取$0.02 / 1M tokens
输入$0.2 / 1M tokens
输出$0.75 / 1M tokens

缓存写入$0.25 / 1M tokens
缓存读取$0.02 / 1M tokens
输入$0.2 / 1M tokens
输出$0.75 / 1M tokens

原价