AI·快讯
💰 模型 · 定价策略

API 价格最高降 80%,大模型厂商开启「智能比」竞争新阶段

7 月 31 日,OpenAI 宣布下调 GPT-5.6 系列 API 价格。其中 Luna 降价 80%,Terra 降价 20%,旗舰模型 Sol 则新增 Fast 模式,在保持能力不变的前提下实现最高 2.5 倍推理速度。降价前一天,Sol 刚刚完成对自身推理系统的优化,服务成本降低 20%,效率提升直接转化为价格下调。

综合公开信息整理 2026-07-31 全文约 3 分钟读完
#OpenAI #GPT-5.6 #API 降价 #智能比 #自优化
−80% GPT-5.6 Luna 最高降幅
2.5× Sol Fast 模式推理速度
−20% 自优化带来的服务成本降低

⚡ 30 秒速览

  • 降了多少:Luna 降价 80%,输入 0.2 美元/百万 token,输出 1.2 美元;Terra 降价 20%,Sol 新增 Fast 模式,价格为标准模式 2 倍,速度 2.5 倍。
  • 为什么能降:GPT-5.6 Sol 被用于优化自身推理系统——自主重写 GPU Kernel、设计执行数百项实验,服务成本降低 20%,Token 效率提升 15% 以上。
  • 市场位置:Luna 在 Artificial Analysis 智能指数 50+ 分区间,单任务成本约 0.05 美元,优于 Claude Opus 5、Gemini 3.6 Flash 等同级模型。
  • 开发者反应:社区认为 Luna 降价幅度「超出预期」,有人直接喊话 Anthropic 跟进,也有网友将其与 Kimi K3 做性价比对比。
  • 深层信号:Sam Altman 称要在「每个模型层级提供最好的价格与智能比」——当模型能力趋近,效率竞争正在成为新主线。

01三款模型,三种调整策略

此次调整覆盖 GPT-5.6 全系列,但三款模型的定位和调整方式各不相同:

GPT-5.6 Luna

降价 80%,输入 0.2 美元/百万 token,输出 1.2 美元。主打高性价比,瞄准开发者的日常高频调用场景。

GPT-5.6 Sol — Fast 模式

价格不变,新增 Fast 模式:2 倍价格,2.5 倍推理速度。此前 Priority Processing 请求自动迁移至 Fast 模式。

GPT-5.6 Terra

降价 20%,输入 2 美元/百万 token,输出 12 美元。定位均衡模型,兼顾性能与成本。

ChatGPT Work / Codex 额度同步调整

Luna 和 Terra 价格下降后,用户在这两项产品中的额度消耗也将减少,Plus/Pro 及以上用户可选择 Terra 和 Luna。

注:以上价格均为 API 调用价格,单位:美元/百万 token。Fast 模式推理速度提升基于标准模式对比,实际效果因任务类型而异。

02价格-性能分布:Luna 的「甜点区」

OpenAI 同步公布了一张基于 Artificial Analysis Intelligence Index v4.1 的价格-性能分布图。Luna 位于图中左上区域——智能指数超过 50 分,单次任务成本仅约 0.05 美元。

与同级模型对比,这个位置的优势相当直观:

🥇 GPT-5.6 LunaOpenAI
0.05
Claude Opus 5Anthropic
0.09
Gemini 3.6 FlashGoogle
0.11
GLM-5.2 Max智谱AI
0.14
DeepSeek V4 ProDeepSeek
0.03

注:柱形长度代表单次任务成本(美元),数值越小越优。DeepSeek V4 Pro 成本更低但智能指数约 44 分,低于 Luna 的 50+ 分。同级模型智能指数相近,成本差异显著。

Sam Altman 随后发文称,OpenAI 的目标是「在每一个模型层级,都提供最好的价格与智能比」。Luna 的降价,本质上是在「50+ 分智能」这个层级上,把价格打到了最低。

03自己优化自己:Sol 的效率闭环

降价前一天,OpenAI 披露了一项关键进展:GPT-5.6 Sol 已经被用于优化自身的推理系统。

在工程师主导下,Sol 自主完成了一系列工作:

🔧 Sol 自优化实践效率提升闭环

  • 自主重写生产环境 GPU Kernel,优化底层计算逻辑,使模型整体服务成本降低 20%。
  • 设计并执行数百项实验,自动对比不同优化策略的效果,筛选最优方案。
  • 监控训练与推理过程,在出现异常时主动介入调整,减少人工干预。
  • 优化推测解码(Speculative Decoding)技术,Token 生成效率提升 15% 以上
本质:模型越强 → 优化越快 → 成本越低 → 价格越便宜。1 天后,效率提升直接体现在产品定价上。

这个闭环意味着什么?

模型不再只是被优化的对象,它同时成为了优化者本身。

Sol 自主重写 Kernel服务成本 −20%Token 效率 +15%价格下调传导至开发者

OpenAI 认为,这标志着模型已经能够帮助研发团队进一步优化自身,形成「模型越强、优化越快」的正向循环。此次 Luna 和 Terra 的降价,正是将这部分效率提升直接返还给开发者。

04开发者社区:炸锅与喊话

消息公布后,开发者社区迅速展开讨论。有人觉得 Luna 降价幅度「超出预期」,有人直接制作了对比图,将 Kimi K3 与 GPT-5.6 Luna 放在一起比较性价比。

一个诚实的注脚:

降价幅度大,不代表每个开发者都会切换——生态绑定、迁移成本、习惯惯性,都是真实存在的阻力。

💬

「Luna 一直是被低估的模型,在 Codex 配合 Computer Use 场景下表现一直不错。降价后终于可以大规模用了。」

— 开发者社区评论
💬

「如果 Luna 未来能进一步提升智能水平,真正接近 Sol 的能力,那 'Intelligence Too Cheap to Meter' 就不再是口号了。」

— 开发者社区评论
💬

「Luna 降价 80% 确实超预期,但 API 额度今天终于能 '轻松一点了'。」

— 开发者社区评论
💬

「该你出招了,@Anthropic。」

— 网友喊话,配图「Hold」表情包

注:以上评论综合自公开社区讨论,不代表编辑立场。开发者实际迁移决策受多种因素影响,价格仅为其中之一。

编辑核心判断

当模型能力逐渐趋近,效率竞争成为新战场——「智能比」正在取代参数规模,成为下一轮大模型竞争的核心指标。谁能在每个智能层级上提供最低成本、最快速度,谁就能锁定下一波开发者的选择。

现在就能用

降价已即时生效,开发者可通过 OpenAI API 平台直接调用 GPT-5.6 系列模型。ChatGPT Work 和 Codex 中的额度消耗同步下调。

OpenAI API 平台 → 立即体验