API 价格最高降 80%,大模型厂商开启「智能比」竞争新阶段
7 月 31 日,OpenAI 宣布下调 GPT-5.6 系列 API 价格。其中 Luna 降价 80%,Terra 降价 20%,旗舰模型 Sol 则新增 Fast 模式,在保持能力不变的前提下实现最高 2.5 倍推理速度。降价前一天,Sol 刚刚完成对自身推理系统的优化,服务成本降低 20%,效率提升直接转化为价格下调。
7 月 31 日,OpenAI 宣布下调 GPT-5.6 系列 API 价格。其中 Luna 降价 80%,Terra 降价 20%,旗舰模型 Sol 则新增 Fast 模式,在保持能力不变的前提下实现最高 2.5 倍推理速度。降价前一天,Sol 刚刚完成对自身推理系统的优化,服务成本降低 20%,效率提升直接转化为价格下调。
此次调整覆盖 GPT-5.6 全系列,但三款模型的定位和调整方式各不相同:
降价 80%,输入 0.2 美元/百万 token,输出 1.2 美元。主打高性价比,瞄准开发者的日常高频调用场景。
价格不变,新增 Fast 模式:2 倍价格,2.5 倍推理速度。此前 Priority Processing 请求自动迁移至 Fast 模式。
降价 20%,输入 2 美元/百万 token,输出 12 美元。定位均衡模型,兼顾性能与成本。
Luna 和 Terra 价格下降后,用户在这两项产品中的额度消耗也将减少,Plus/Pro 及以上用户可选择 Terra 和 Luna。
注:以上价格均为 API 调用价格,单位:美元/百万 token。Fast 模式推理速度提升基于标准模式对比,实际效果因任务类型而异。
OpenAI 同步公布了一张基于 Artificial Analysis Intelligence Index v4.1 的价格-性能分布图。Luna 位于图中左上区域——智能指数超过 50 分,单次任务成本仅约 0.05 美元。
与同级模型对比,这个位置的优势相当直观:
注:柱形长度代表单次任务成本(美元),数值越小越优。DeepSeek V4 Pro 成本更低但智能指数约 44 分,低于 Luna 的 50+ 分。同级模型智能指数相近,成本差异显著。
Sam Altman 随后发文称,OpenAI 的目标是「在每一个模型层级,都提供最好的价格与智能比」。Luna 的降价,本质上是在「50+ 分智能」这个层级上,把价格打到了最低。
降价前一天,OpenAI 披露了一项关键进展:GPT-5.6 Sol 已经被用于优化自身的推理系统。
在工程师主导下,Sol 自主完成了一系列工作:
这个闭环意味着什么?
模型不再只是被优化的对象,它同时成为了优化者本身。
OpenAI 认为,这标志着模型已经能够帮助研发团队进一步优化自身,形成「模型越强、优化越快」的正向循环。此次 Luna 和 Terra 的降价,正是将这部分效率提升直接返还给开发者。
消息公布后,开发者社区迅速展开讨论。有人觉得 Luna 降价幅度「超出预期」,有人直接制作了对比图,将 Kimi K3 与 GPT-5.6 Luna 放在一起比较性价比。
一个诚实的注脚:
降价幅度大,不代表每个开发者都会切换——生态绑定、迁移成本、习惯惯性,都是真实存在的阻力。
「Luna 一直是被低估的模型,在 Codex 配合 Computer Use 场景下表现一直不错。降价后终于可以大规模用了。」
「如果 Luna 未来能进一步提升智能水平,真正接近 Sol 的能力,那 'Intelligence Too Cheap to Meter' 就不再是口号了。」
「Luna 降价 80% 确实超预期,但 API 额度今天终于能 '轻松一点了'。」
「该你出招了,@Anthropic。」
注:以上评论综合自公开社区讨论,不代表编辑立场。开发者实际迁移决策受多种因素影响,价格仅为其中之一。
当模型能力逐渐趋近,效率竞争成为新战场——「智能比」正在取代参数规模,成为下一轮大模型竞争的核心指标。谁能在每个智能层级上提供最低成本、最快速度,谁就能锁定下一波开发者的选择。
降价已即时生效,开发者可通过 OpenAI API 平台直接调用 GPT-5.6 系列模型。ChatGPT Work 和 Codex 中的额度消耗同步下调。
OpenAI API 平台 → 立即体验