GPT-6 Sol 与 Luna 发布:OpenAI 用「白菜价」杀进 DeepSeek 腹地
OpenAI 正式发布 GPT-6 Sol 与 GPT-6 Luna,API 价格降到上一代的一半左右:Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元(约合 ¥0.7 / ¥3.5),Sol 为 2 美元 / 10 美元。按普通新请求(缓存未命中)算,Luna 已经比 DeepSeek V4.1 Flash 更便宜,而且没有峰谷定价。DeepSeek 的王牌仍在 —— 闲时缓存命中输入只要 ¥0.02/M,综合能力也更强(100 万上下文、图文理解、工具调用)。但「低价 = DeepSeek 招牌」这件事,从今天起不成立了。
本月早些时候 OpenAI 发布了 GPT-6 Astra,并称其为目前能力最强、对齐程度最高的模型;Astra 冲的是能力天花板。Sol 和 Luna 承担的是另一件事 —— 把 Astra 的进展搬到更快、更便宜的产品层级上。用 OpenAI 的话说,两款模型沿用了与 Astra 相近的训练方法,覆盖专业工作、事实准确性、编程、计算机操作和对齐。
01价格直接对半砍
这是本次发布最狠的一刀。两款新模型的 API 定价相比上一代几乎腰斩:
| 模型 | 输入(每百万 Token) | 输出(每百万 Token) | 相比上一代 |
|---|---|---|---|
| GPT-6 Astra | $10 | $50 | 能力上限档,不做日常默认 |
| GPT-6 Sol | $2 | $10 | 原 GPT-5.6 Sol 促销价 $4 / $20 |
| GPT-6 Luna | $0.1 | $0.5 | 原 GPT-5.6 Luna $0.2 / $1.2 |
OpenAI 把降价归因于推理基础设施和缓存效率的改善,并称目的是直接让利用户。Sam Altman 在发布后强调,真正重要的指标是完成一项任务要花多少钱,在这个维度上他认为目前市场上没有产品能匹敌 Sol 和 Luna。
和 DeepSeek 正面比一比
| 场景 | Luna | DeepSeek V4.1 Flash | 谁更便宜 |
|---|---|---|---|
| 普通新请求(缓存未命中)输入 | 约 ¥0.7/M | 闲时 ¥1 / 高峰 ¥2 | Luna,且无峰谷波动 |
| 普通新请求输出 | 约 ¥3.5/M | 闲时 ¥4 / 高峰 ¥8 | Luna |
| 闲时缓存命中输入 | 需看缓存折扣 | ¥0.02/M | DeepSeek 仍是价格王牌 |
| 综合能力 | 轻量高频定位 | 100 万上下文、图文理解、工具调用、思考模式 | DeepSeek 明显更高 |
DeepSeek 的 ¥0.02/M 闲时缓存命中价远低于 Luna,这是它手里真正的王牌;V4.1 Flash 的综合能力也明显更强。Luna 赢的是普通请求的确定性 —— 不用算峰谷、不用担心时段涨价。
02三档模型怎么分工
Astra 每百万 Token 10 美元输入、50 美元输出的价格,决定了它很难成为日常工作默认选项。三档的分工因此变得非常清晰:
| 模型 | 定位 | 适合什么活 |
|---|---|---|
| GPT-6 Astra | 最高能力上限 | 高难度、高价值任务;计算机操作能力最强的仍是它 |
| GPT-6 Sol | 主流专业档 | 需要较强推理、编程和 Agent 能力的日常专业工作 |
| GPT-6 Luna | 白菜价走量档 | 高频、规模化工作:代码检查、批量修改、轻量开发、多 Agent 并发 |
换句话说,OpenAI 争夺的重点已经从榜单最高分延伸到「每一美元能完成多少工作」。
03跑分:赢了什么、输了什么
官方公布的成绩里,Sol 的竞争力集中在专业工作和 Agent 任务:
| 评测 | GPT-6 Sol | 对比对象 | 成本 |
|---|---|---|---|
| AutomationBench 销售/营销/运营/客服/财务/HR 工作流 | 33.2%(xhigh) | Claude Opus 5 最大推理 26.9%;超过低推理的 GPT-6 Astra | 仅 Opus 5 的 9% |
| Agents' Last Exam 55 个细分行业长链路任务 | 56.4%(最大推理) | 超过 Claude Opus 5 在该评测的最高成绩 | 低约 60% |
| DeepSWE v1.1 真实代码库软件工程 | 68.8%(最大推理) | Claude Fable 5 最高 69.9%;DeepSeek V4.1 Flash 74.2% | 比 Fable 5 低约 80% |
| FrontierCode 代码能否直接合并进真实项目 | 较上一代明显进步 | 以更低成本追平 Claude Fable 5.1 xhigh | 更低 |
| OSWorld 2.0(离线) 计算机操作 | 60.5%(xhigh) | Claude Opus 5 medium 60.3% | 低约 80% |
Luna 在 DeepSWE v1.1 得到 66.6%,与 Claude Opus 5 和 Fable 5 中等推理强度表现相近,但任务成本分别低 93% 和 96%;在 OSWorld 2.0 中最大推理成绩超过 GPT-5.6 Sol medium,成本只有后者的十分之一。
事实准确性也有改善:OpenAI 用用户曾标记事实错误的匿名真实对话做内部测试,GPT-6 Sol 的错误数量约为 GPT-5.6 Sol 的一半,开始接近 Astra 的可靠性。Luna 在较高推理强度下,则以约百分之一的成本追平 GPT-5.6 Sol。
Artificial Analysis 的 Intelligence Index 和 Coding Agent Index 显示,Sol 与 Luna 的总体智能水平和 GPT-5.6 系列大致持平 —— 部分项目进步,也有部分项目回退,真正显著的变化来自成本下降。
04实测反馈与视觉短板
模型发布后首批实测很快呈现出两种截然不同的评价。
- 效率提升明显:开发者 Flavio Adamo 提前试用 GPT-6 Sol 后表示,过去在 GPT-5.6 上通常要一小时的任务,如今经常 20 分钟内完成,Token 消耗还不到原来的一半。
- 可用成品度不错:用 GPT-6 Sol 实测威尼斯运河快艇游戏,模型交付了可直接游玩的 Three.js 成品,桥洞闯关、倒计时、航迹尾流、水面反射和追逐镜头等核心功能均能正常运行。
- 视觉质量是短板:aipulsedaily 用同一提示词让 GPT-6 Sol 与 Claude Opus 5.5 构建纽约 Three.js 场景,认为 Opus 5.5 更完整地呈现了街道、出租车、屋顶、布鲁克林大桥和中央公园;Sol 的结果更接近静态画面,缺少相机移动和持续渲染循环。Bridgebench 另一组同提示词测试也认为 Opus 5.5 的视觉品味和设计完成度明显更高。
性能、价格、速度是不可能三角。追求单次最佳效果的创意任务,Claude 仍可能更有吸引力;需要同时派出大量 Agent、反复迭代或长期运行的工作流,OpenAI 的价格优势会迅速累积。
另外,Sol 和 Luna 继承了 Astra 的表达调整:会减少术语、古怪措辞和低价值细节,回答略短,同时更清楚地说明自己检查过什么、没检查什么。对需要连续协作的编程和技术任务,这比「单次回答漂亮」更重要。
05缓存升级才是省钱大头
除了单价,OpenAI 还更新了 GPT-6 的提示词缓存机制:
- 提高默认缓存命中率系统会让 Agent 更充分地复用已有上下文,缓存输入读取可获 90% 折扣。
- 控制台可观测开发者能查看缓存比例和变化,也能检查哪些提示词没能命中缓存。
- 中途调整参数也保缓存推理强度和可用工具可以在对话中途调整,同时保留此前上下文的缓存。
- 新的显式断点允许开发者决定提示词前缀在哪里结束,以便优化复用范围。
对于持续读取代码库、文档和历史对话的 Agent 而言,缓存节省的费用可能比公开单价下降更重要。
按 Artificial Analysis 测算,GPT-6 Sol max 完成一次 Intelligence Index 任务的成本约 $1.06(GPT-5.6 Sol max 为 $1.99),GPT-6 Luna max 约 $0.07(上一代 $0.18)。两款模型的输出 Token 用量反而略有增加(Sol 约 2.9 万 → 3.1 万,Luna 4.1 万 → 5.1 万),但价格下降仍然抵消了用量增加。
06谁能用、怎么用
| 入口 | 可用情况 |
|---|---|
| ChatGPT Work / Codex | Plus、Pro、Business、Enterprise、Edu 用户即日起可用 |
| 桌面应用 | Free 和 Go 用户可使用 GPT-6 Luna |
| ChatGPT 普通 Chat 对话 | 两款模型暂未进入,权限当天逐步开放(Codex 通常更快) |
| API | 已可通过 gpt-6-sol 与 gpt-6-luna 调用 |
OpenAI 产品负责人 Tibo Sottiaux 还宣布,Plus、Pro 和 Business 账户将获得一次预存的使用额度重置,让订阅用户能在现有周期内多使用一轮额度。想盯重置节奏的,可以看本站的 Tibo 重置雷达,机制解读见《Codex 额度重置是怎么回事》。
如果你是 Pro 20X 这类重度档位用户,额度与套餐变动近一个月非常频繁,建议先确认自己的订阅状态是否正常扣款 —— 详见《ChatGPT Pro 20X 停售后怎么续费》与《20X 一次性回归》。
07DeepSeek 还剩什么
GPT-6 Astra 发布时,OpenAI 展示的是「能力能抵达多高」;Sol 和 Luna 上线后,OpenAI 开始考虑智能密度的经济效益。这件事的影响有两层:
- 价格鸿沟被抹平:Luna 的普通输入输出价格进入 DeepSeek V4.1 Flash 区间,两者差距明显缩小。
- 体系优势开始计分:OpenAI 背后有 ChatGPT Work、Codex 和 API 组成的完整产品体系,价格接近之后,产品入口、工具支持、运行稳定性和开发者生态都会重新影响选择。
DeepSeek 用低价让整个行业重新计算 Token 的价值,OpenAI 则把这种压力带进了全球前沿模型的核心战场。接下来,低价不会再是某一家公司的招牌,而会成为所有头部模型都绕不开的必答题。
08常见问题
| 问题 | 答案 |
|---|---|
| GPT-6 Sol 和 Luna 的 API 价格是多少 | Sol 每百万 Token 输入 $2、输出 $10;Luna 输入 $0.1、输出 $0.5,均约为上一代一半。 |
| Luna 真的比 DeepSeek 便宜吗 | 只在「缓存未命中的普通请求」上成立(Luna 约 ¥0.7 / ¥3.5,DeepSeek 闲时 ¥1 / ¥4、高峰 ¥2 / ¥8)。DeepSeek 闲时缓存命中输入仍只要 ¥0.02/M,且综合能力更强。 |
| 三款 GPT-6 模型怎么选 | Astra 冲能力上限;Sol 面向需要推理、编程和 Agent 能力的主流专业任务;Luna 用极低价格承接高频规模化工作。 |
| 能力比上一代强多少 | Artificial Analysis 认为总体智能与 GPT-5.6 系列大致持平,显著变化主要来自成本下降;事实准确性上 Sol 错误数约为 GPT-5.6 Sol 的一半。 |
| 免费用户能用吗 | Free 和 Go 用户可在桌面应用中使用 GPT-6 Luna。 |
| API 模型名是什么 | gpt-6-sol 与 gpt-6-luna,API 用户已可调用。 |
| 有额度重置吗 | OpenAI 产品负责人 Tibo Sottiaux 宣布 Plus、Pro 和 Business 账户将获得一次预存额度重置。 |
| 视觉/创意任务选谁 | 首批实测显示 Claude Opus 5.5 的视觉品味和完成度更高;Sol 更适合成本敏感、需要大量并发的任务。 |
资料来源:APPSO《刚刚,GPT-6 新模型掀桌!「白菜价」杀进 DeepSeek 腹地》(2026-09-23),数据引自 OpenAI 官方公布与 Artificial Analysis 测算。阅读原文 →
