AI Tool工具与教程 返回主页 →

GPT-6 Sol 与 Luna 发布:OpenAI 用「白菜价」杀进 DeepSeek 腹地

AI Tool· · 约 9 分钟阅读· 更新于 2026-09-23
先看结论

OpenAI 正式发布 GPT-6 SolGPT-6 Luna,API 价格降到上一代的一半左右:Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元(约合 ¥0.7 / ¥3.5),Sol 为 2 美元 / 10 美元。按普通新请求(缓存未命中)算,Luna 已经比 DeepSeek V4.1 Flash 更便宜,而且没有峰谷定价。DeepSeek 的王牌仍在 —— 闲时缓存命中输入只要 ¥0.02/M,综合能力也更强(100 万上下文、图文理解、工具调用)。但「低价 = DeepSeek 招牌」这件事,从今天起不成立了。

本月早些时候 OpenAI 发布了 GPT-6 Astra,并称其为目前能力最强、对齐程度最高的模型;Astra 冲的是能力天花板。Sol 和 Luna 承担的是另一件事 —— 把 Astra 的进展搬到更快、更便宜的产品层级上。用 OpenAI 的话说,两款模型沿用了与 Astra 相近的训练方法,覆盖专业工作、事实准确性、编程、计算机操作和对齐。

01价格直接对半砍

这是本次发布最狠的一刀。两款新模型的 API 定价相比上一代几乎腰斩:

模型输入(每百万 Token)输出(每百万 Token)相比上一代
GPT-6 Astra$10$50能力上限档,不做日常默认
GPT-6 Sol$2$10原 GPT-5.6 Sol 促销价 $4 / $20
GPT-6 Luna$0.1$0.5原 GPT-5.6 Luna $0.2 / $1.2

OpenAI 把降价归因于推理基础设施和缓存效率的改善,并称目的是直接让利用户。Sam Altman 在发布后强调,真正重要的指标是完成一项任务要花多少钱,在这个维度上他认为目前市场上没有产品能匹敌 Sol 和 Luna。

和 DeepSeek 正面比一比

场景LunaDeepSeek V4.1 Flash谁更便宜
普通新请求(缓存未命中)输入约 ¥0.7/M闲时 ¥1 / 高峰 ¥2Luna,且无峰谷波动
普通新请求输出约 ¥3.5/M闲时 ¥4 / 高峰 ¥8Luna
闲时缓存命中输入需看缓存折扣¥0.02/MDeepSeek 仍是价格王牌
综合能力轻量高频定位100 万上下文、图文理解、工具调用、思考模式DeepSeek 明显更高
别只看单价

DeepSeek 的 ¥0.02/M 闲时缓存命中价远低于 Luna,这是它手里真正的王牌;V4.1 Flash 的综合能力也明显更强。Luna 赢的是普通请求的确定性 —— 不用算峰谷、不用担心时段涨价。

02三档模型怎么分工

Astra 每百万 Token 10 美元输入、50 美元输出的价格,决定了它很难成为日常工作默认选项。三档的分工因此变得非常清晰:

模型定位适合什么活
GPT-6 Astra最高能力上限高难度、高价值任务;计算机操作能力最强的仍是它
GPT-6 Sol主流专业档需要较强推理、编程和 Agent 能力的日常专业工作
GPT-6 Luna白菜价走量档高频、规模化工作:代码检查、批量修改、轻量开发、多 Agent 并发

换句话说,OpenAI 争夺的重点已经从榜单最高分延伸到「每一美元能完成多少工作」

03跑分:赢了什么、输了什么

官方公布的成绩里,Sol 的竞争力集中在专业工作和 Agent 任务

评测GPT-6 Sol对比对象成本
AutomationBench
销售/营销/运营/客服/财务/HR 工作流
33.2%(xhigh)Claude Opus 5 最大推理 26.9%;超过低推理的 GPT-6 Astra仅 Opus 5 的 9%
Agents' Last Exam
55 个细分行业长链路任务
56.4%(最大推理)超过 Claude Opus 5 在该评测的最高成绩低约 60%
DeepSWE v1.1
真实代码库软件工程
68.8%(最大推理)Claude Fable 5 最高 69.9%;DeepSeek V4.1 Flash 74.2%比 Fable 5 低约 80%
FrontierCode
代码能否直接合并进真实项目
较上一代明显进步以更低成本追平 Claude Fable 5.1 xhigh更低
OSWorld 2.0(离线)
计算机操作
60.5%(xhigh)Claude Opus 5 medium 60.3%低约 80%

Luna 在 DeepSWE v1.1 得到 66.6%,与 Claude Opus 5 和 Fable 5 中等推理强度表现相近,但任务成本分别低 93% 和 96%;在 OSWorld 2.0 中最大推理成绩超过 GPT-5.6 Sol medium,成本只有后者的十分之一。

事实准确性也有改善:OpenAI 用用户曾标记事实错误的匿名真实对话做内部测试,GPT-6 Sol 的错误数量约为 GPT-5.6 Sol 的一半,开始接近 Astra 的可靠性。Luna 在较高推理强度下,则以约百分之一的成本追平 GPT-5.6 Sol。

第三方机构看得更克制

Artificial Analysis 的 Intelligence Index 和 Coding Agent Index 显示,Sol 与 Luna 的总体智能水平和 GPT-5.6 系列大致持平 —— 部分项目进步,也有部分项目回退,真正显著的变化来自成本下降

04实测反馈与视觉短板

模型发布后首批实测很快呈现出两种截然不同的评价。

怎么选

性能、价格、速度是不可能三角。追求单次最佳效果的创意任务,Claude 仍可能更有吸引力;需要同时派出大量 Agent、反复迭代或长期运行的工作流,OpenAI 的价格优势会迅速累积。

另外,Sol 和 Luna 继承了 Astra 的表达调整:会减少术语、古怪措辞和低价值细节,回答略短,同时更清楚地说明自己检查过什么、没检查什么。对需要连续协作的编程和技术任务,这比「单次回答漂亮」更重要。

05缓存升级才是省钱大头

除了单价,OpenAI 还更新了 GPT-6 的提示词缓存机制:

  1. 提高默认缓存命中率
    系统会让 Agent 更充分地复用已有上下文,缓存输入读取可获 90% 折扣
  2. 控制台可观测
    开发者能查看缓存比例和变化,也能检查哪些提示词没能命中缓存
  3. 中途调整参数也保缓存
    推理强度和可用工具可以在对话中途调整,同时保留此前上下文的缓存
  4. 新的显式断点
    允许开发者决定提示词前缀在哪里结束,以便优化复用范围

对于持续读取代码库、文档和历史对话的 Agent 而言,缓存节省的费用可能比公开单价下降更重要

按 Artificial Analysis 测算,GPT-6 Sol max 完成一次 Intelligence Index 任务的成本约 $1.06(GPT-5.6 Sol max 为 $1.99),GPT-6 Luna max 约 $0.07(上一代 $0.18)。两款模型的输出 Token 用量反而略有增加(Sol 约 2.9 万 → 3.1 万,Luna 4.1 万 → 5.1 万),但价格下降仍然抵消了用量增加

06谁能用、怎么用

入口可用情况
ChatGPT Work / CodexPlus、Pro、Business、Enterprise、Edu 用户即日起可用
桌面应用Free 和 Go 用户可使用 GPT-6 Luna
ChatGPT 普通 Chat 对话两款模型暂未进入,权限当天逐步开放(Codex 通常更快)
API已可通过 gpt-6-solgpt-6-luna 调用

OpenAI 产品负责人 Tibo Sottiaux 还宣布,Plus、Pro 和 Business 账户将获得一次预存的使用额度重置,让订阅用户能在现有周期内多使用一轮额度。想盯重置节奏的,可以看本站的 Tibo 重置雷达,机制解读见《Codex 额度重置是怎么回事》

重度订阅用户注意

如果你是 Pro 20X 这类重度档位用户,额度与套餐变动近一个月非常频繁,建议先确认自己的订阅状态是否正常扣款 —— 详见《ChatGPT Pro 20X 停售后怎么续费》《20X 一次性回归》

07DeepSeek 还剩什么

GPT-6 Astra 发布时,OpenAI 展示的是「能力能抵达多高」;Sol 和 Luna 上线后,OpenAI 开始考虑智能密度的经济效益。这件事的影响有两层:

DeepSeek 用低价让整个行业重新计算 Token 的价值,OpenAI 则把这种压力带进了全球前沿模型的核心战场。接下来,低价不会再是某一家公司的招牌,而会成为所有头部模型都绕不开的必答题。

08常见问题

问题答案
GPT-6 Sol 和 Luna 的 API 价格是多少Sol 每百万 Token 输入 $2、输出 $10;Luna 输入 $0.1、输出 $0.5,均约为上一代一半。
Luna 真的比 DeepSeek 便宜吗只在「缓存未命中的普通请求」上成立(Luna 约 ¥0.7 / ¥3.5,DeepSeek 闲时 ¥1 / ¥4、高峰 ¥2 / ¥8)。DeepSeek 闲时缓存命中输入仍只要 ¥0.02/M,且综合能力更强。
三款 GPT-6 模型怎么选Astra 冲能力上限;Sol 面向需要推理、编程和 Agent 能力的主流专业任务;Luna 用极低价格承接高频规模化工作。
能力比上一代强多少Artificial Analysis 认为总体智能与 GPT-5.6 系列大致持平,显著变化主要来自成本下降;事实准确性上 Sol 错误数约为 GPT-5.6 Sol 的一半。
免费用户能用吗Free 和 Go 用户可在桌面应用中使用 GPT-6 Luna。
API 模型名是什么gpt-6-solgpt-6-luna,API 用户已可调用。
有额度重置吗OpenAI 产品负责人 Tibo Sottiaux 宣布 Plus、Pro 和 Business 账户将获得一次预存额度重置。
视觉/创意任务选谁首批实测显示 Claude Opus 5.5 的视觉品味和完成度更高;Sol 更适合成本敏感、需要大量并发的任务。

资料来源:APPSO《刚刚,GPT-6 新模型掀桌!「白菜价」杀进 DeepSeek 腹地》(2026-09-23),数据引自 OpenAI 官方公布与 Artificial Analysis 测算。阅读原文 →