导语:7月30日,OpenAI 宣布下调 GPT-5.6 系列价格并提升 Sol 的 API 速度。其中最快、最便宜的 Luna 降价80%,输入、输出价格分别降至每百万token 0.20美元与1.20美元(此前为1美元与6美元);面向日常工作的均衡款 Terra 降价20%,输入、输出降至2美元与12美元;最强的 Sol 价格维持不变,但在 API 新增 Fast 模式,速度最高为标准模式的2.5倍、价格为标准模式的两倍。
摘要:
7月30日,OpenAI 宣布下调 GPT-5.6 系列价格并提升 Sol 的 API 速度。其中最快、最便宜的 Luna 降价80%,输入、输出价格分别降至每百万token 0.20美元与1.20美元(此前为1美元与6美元);面向日常工作的均衡款 Terra 降价20%,输入、输出降至2美元与12美元;最强的 Sol 价格维持不变,但在 API 新增 Fast 模式,速度最高为标准模式的2.5倍、价格为标准模式的两倍。OpenAI 称降价源于 GPT-5.6 研发过程中的效率提升——包括模型自主重写与优化生产代码、提高 token 生成效率等,把这些收益让渡给客户。这一动作被视为 AI 价格战升级的标志。(注:本条发布于7月30日,略早于本期其他条目。)
正文(译文):
〔此处粘贴原文配图:GPT-5.6 价格-性能主题图〕
以 GPT-5.6 推进性价比前沿
通过让每一层都更高效,OpenAI 正在为更多企业工作负载提供每一美元更强的性能。
让智能匹配结果
昨天,我们分享了 GPT?5.6 如何帮助自身变得更高效地运行。今天,我们把这些收益以更低的价格传递给客户——下调 GPT?5.6 Luna 与 Terra 的价格,并在 API 中让 GPT?5.6 Sol 拥有更快的性能。这些更新合在一起,帮助客户从投入 AI 的每一美元中获得更多,并在时间紧要时更快行动。
自今日起,我们最快、最实惠的模型 GPT?5.6 Luna 价格下降80%,面向日常工作的均衡款 GPT?5.6 Terra 价格下降20%。Luna 与 Terra 的这一降价,也体现在使用 Codex 和 ChatGPT Work 时对付费订阅用量的计入方式上。Luna 让企业以更具成本效益的方式、在很高的质量水平上处理高并发工作;它能使用工具、完成多步工作流,使更广泛的一类 AI 应用得以大规模实际运行。
让先进智能更充裕、更可负担,是 OpenAI"确保 AGI 惠及全人类"使命的核心。这些变化把这一承诺付诸实践,它们体现了我们在模型的构建、服务与应用方式上多年的改进。
我们还在 API 中引入 Fast 模式,取代原有的 Priority Processing(优先处理)。对 GPT?5.6 Sol 而言,Fast 模式现在以两倍价格提供最高2.5倍于标准处理的速度,且智能水平不变。Fast 模式向后兼容:标记为 priority 的请求将自动使用 Fast 模式。
〔此处粘贴原文配图:客户证言(Replit、Notion、Ramp、Blitzy、Cognition、Dust 共6条轮播)〕
"GPT?5.6 Luna 是我们最接近'智能便宜到无需计量'的一次。我从未见过如此实惠的模型有这般强大——它为 Replit 解锁了一些我们本以为很久之后才会去做的用例。"——Michele Catasta,Replit 总裁兼 AI 负责人
让智能匹配结果
高效使用 AI,始于结果。风险、出错代价、紧迫性与规模,决定了智能、速度、可靠性与成本之间的恰当平衡;而这一平衡可能在工作流的每一步之间发生变化。
GPT?5.6 为企业优化这一等式提供了更大空间。Luna 以约每项任务6美分的成本、近九倍的速度,提供了与一年前前沿级模型相当的性能。在专业工作上(以 Agents' Last Exam 衡量),Luna 以估计低近99%的每项任务成本,超越了 Fable 5。
在实践中,企业可以先定义所需的结果与质量标准,再通过评测确定:在哪些环节增加智能能实质性改善结果,在哪些环节更快、更低成本的处理即可交付同等质量。例如一个编码工作流,可能用 Sol 来消解不确定性、制定方案,再用 Luna 来实现已明确定义的改动、编写并运行测试、评估结果;另一个工作流则可能需要不同的平衡。
GPT?5.6 家族拓展了这些选择的范围。企业可以在每个阶段应用最有用的智能,同时为其创造的价值支付恰当的价格。
而要提供这种灵活性,先要让模型背后的每一层都更高效。
我们如何推进效率前沿
我们的效率优势来自于改进模型、运行模型的推理系统,以及把模型连接到工具与上下文的智能体框架(agentic harness)。GPT?5.6 模型以更直接的路径处理工作:更好的路由让硬件保持高产出,优化后的生产软件更高效地生成 token,更智能的上下文管理帮助智能体避免重复已完成的工作。这些改进合在一起,让我们用同样的算力完成更多有用的工作,降低每个结果所需的时间、token 与成本。
GPT?5.6 Sol 正越来越多地帮助我们发现并实现下一轮收益。在由人主导的流程中,Sol 自主重写并优化了生产内核(kernel),设计并运行了数百项实验以改进 token 生成,并监控训练、在出现问题时介入。内核方面的工作帮助将服务该模型的端到端成本降低了20%,其实验则将 token 生成效率提升了逾15%。这项工作仍在继续,形成了更紧密的反馈循环:随着我们的模型改进、能够更自主地工作,我们提升效率的能力也随之加速。关于 GPT?5.6 背后的工程细节,可进一步阅读相关文章。
为规模而建的算力策略
满足对充裕智能的需求,既需要更多算力,也需要更高产出的算力。我们正在构建有韧性的基础设施组合,并为每种工作负载匹配最适合运行它的系统。这一思路支撑起性价比曲线的两端:在低成本端,Luna 与 Terra 的新价格让高并发工作在更大规模上变得经济;在前沿端,Fast 模式让 API 客户在响应时间重要时更快用上 Sol。
企业可以把更多 AI 融入日常运营,而不必在最重要的工作上牺牲速度。大规模文档分析、客户交互分类与常规实现工作,都可以变得可广泛经济地运行;而复杂的 Sol 工作负载,则可以在溢价合理时跑得更快。
这些收益可以复利叠加。在由人主导的流程中,更强的模型帮助我们的技术团队发现下一代改进,缩短通往更好性能与更低成本的路径。我们的策略始终聚焦于同时推进能力与效率,让每一代智能都能以更低成本完成更多工作。
可用性与定价
GPT?5.6 Terra 与 Luna 仍在 ChatGPT Work、Codex 与 OpenAI API 中提供。在 ChatGPT Work 与 Codex 中,Free 与 Go 用户可使用 Terra,Plus、Pro、Business 与 Enterprise 用户可选择 Terra 与 Luna。
自7月30日起,API 定价为:Terra 每百万输入token 2美元、每百万输出token 12美元;Luna 每百万输入token 0.20美元、每百万输出token 1.20美元。Sol 定价保持不变。ChatGPT 与 Codex 的订阅价格与配额预算保持不变,而 Terra、Luna 的使用现在消耗更少的额度。定价变更将于今日晚些时候开始在 AWS 上线。
GPT?5.6 Sol 的 Fast 模式取代 API 中的 Priority Processing,并与 Codex 中的 /fast 对齐。已标记为 priority 的现有 API 请求将继续有效。

扫一扫,或长按识别二维码
关注艾瑞网官方微信公众号