GPT-6 Luna 多少钱?输入 $0.10 / 输出 $0.50,前沿模型地板价全解析
GPT-6 Luna 是 OpenAI 于 2026 年 9 月 22 日发布的 GPT-6 系列轻量级模型,定位为“专注高吞吐量任务的最具效率模型”。它是目前 GPT-6 家族中最便宜的模型,每百万输入 Token 仅 $0.10,每百万输出 Token 仅 $0.50,价格是旗舰 Sol 的 1/20。本文拆解 Luna 的完整定价结构、缓存费用、长提示词溢价规则,以及真实工作负载下的成本估算。
一、标准定价:输入 $0.10,输出 $0.50
GPT-6 Luna 的 API 标准定价如下(每百万 Token):
| 计费项 | 价格(/百万 Token) |
|---|---|
| 输入 | $0.10 |
| 输出 | $0.50 |
| 缓存读取 | $0.01 |
| 缓存写入 | $0.125 |
缓存读取价格仅为未缓存输入的 10%,缓存写入为未缓存输入价格的 1.25 倍。
与上一代 GPT-5.6 Luna 相比,GPT-6 Luna 的输入价格从 $0.20 降至 $0.10,输出价格从 $1.20 降至 $0.50,整体降幅约 50%-58%。
二、长提示词溢价:超过 272K 输入 Token 后翻倍
GPT-6 Luna 对长提示词设有价格阶梯。当单次请求的输入 Token 超过 272,000 时,整个请求的计费标准将上调:
| 计费项 | ≤272K 输入 | >272K 输入 |
|---|---|---|
| 输入 | $0.10 | $0.20 |
| 输出 | $0.50 | $0.75 |
| 缓存读取 | $0.01 | $0.02 |
超过 272K 后,输入和缓存费用翻倍,输出费用为 1.5 倍。
三、批量与 Flex 处理:五折优惠
通过 OpenAI 的 Batch API 或 Flex 处理模式调用 Luna,价格可按标准费率的 50% 计算。如果任务对实时性要求不高,批量处理是进一步降低成本的有效途径。Fast 模式则按适用费率的 2 倍计费。
四、实际工作负载成本估算
以 每月 1000 万输入 Token + 200 万输出 Token 为例,对比三档模型的成本:
| 模型 | 月费用(无缓存) | 月费用(80% 缓存命中) |
|---|---|---|
| Luna | $2.00 | $1.28 |
| Sol | $40.00 | $25.60 |
| Astra | $200.00 | — |
同样的工作负载,Luna 的成本仅为 Sol 的 1/20、Astra 的 1/100。如果 80% 的输入 Token 命中缓存,Luna 的月费用可进一步降至 $1.28。
五、开放范围与使用方式
GPT-6 Luna 目前已在以下渠道开放:
- ChatGPT Work 和 Codex:Plus、Pro、Business、Enterprise、Edu 用户可用
- API:模型名称为
gpt-6-luna,同步开放 - 免费用户:Free 和 Go 用户可在桌面应用中使用 Luna
普通聊天界面暂未接入 Luna。
六、总结
| 核心指标 | 数据 |
|---|---|
| 输入价格 | $0.10 / 百万 Token |
| 输出价格 | $0.50 / 百万 Token |
| 缓存读取 | $0.01 / 百万 Token |
| 缓存写入 | $0.125 / 百万 Token |
| 长提示词溢价 | >272K 输入后输入翻倍、输出 1.5 倍 |
| 批量/Flex 折扣 | 五折 |
| 月成本示例 | 1000 万输入 + 200 万输出 ≈ $2.00 |
GPT-6 Luna 以 $0.10 的输入价刷新了前沿级模型的定价底线,适合分类、提取、路由、短摘要以及 实在Agent 内部的短重复调用等高吞吐量任务。如果你的任务需要多步深度推理,Sol 仍是更合适的选择;但如果任务定义清晰、调用频次高,Luna 是当前性价比最高的选项之一。



