GPT-5.6 价格暴降 80%,Luna 推理成本降至 0.20 美元/百万 token
OpenAI 于 7 月 17 日宣布 GPT-5.6 全线降价,入门款 Luna 降幅高达 80%,每百万输入 token 仅需 0.20 美元;高端款 Terra 降价 20%,并推出 Sol 快速模式,速度最高提升 2.5 倍。降价即日起在 Codex 和 ChatGPT Work 中生效。
OpenAI 于 7 月 17 日宣布 GPT-5.6 全线降价,入门款 Luna 降幅高达 80%,每百万输入 token 仅需 0.20 美元;高端款 Terra 降价 20%,并推出 Sol 快速模式,速度最高提升 2.5 倍。降价即日起在 Codex 和 ChatGPT Work 中生效。
OpenAI 此次降价覆盖 GPT-5.6 全系,但各型号调整幅度差异明显。入门款 Luna 降幅最大,高端款 Terra 温和下调,旗舰款 Sol 定价不变但新增模式选项。
注:柱形为示意性缩放,非严格按比例;价格以左侧标注为准。Luna 输出价格为 1.20 美元/百万 token,Terra 输出价格为 12 美元/百万 token,Sol 输出价格为 60 美元/百万 token(快速模式翻倍)。
一个更直观的对比:Luna 与一年前的前沿模型性能相当,但每项任务成本约 6 美分,速度却快了近九倍。在 Agents' Last Exam 评测中,Luna 的表现甚至优于 Fable 5,且每项任务成本估计降低了近 99%。
OpenAI 表示,这次降价并非市场补贴,而是 GPT-5.6 自身运行效率提升后的回馈。效率提升来自技术栈全链路优化,涵盖研究、推理和智能体框架。
两个关键数字:
推测性解码(Speculative Decoding)是一种加速推理的技术,通过小模型快速生成候选 token 再由大模型校验,显著降低延迟。两项改进叠加,使 Luna 能以更低价格提供更高性能。
这不是一次性的降价动作。工程效率每提升一步,价格就向用户传导一步。
在 OpenAI 公布的对比中,Luna 与一年前的旗舰模型 Fable 5 在 Agents' Last Exam 上表现相当,但成本差距惊人。
每项任务成本约 6.5 美元,推理速度中等,性能在当时的基准中处于领先。
每项任务成本约 6 美分,速度约为 Fable 5 的 9 倍,性能相当甚至略优。
成本降低近 99%,速度提升近 9 倍,性能一分未减。这是整个行业推理效率跃迁的真实写照——前沿模型的成本曲线正在以每年一个数量级的速度下降。
一个诚实的注脚:Agents' Last Exam 主要评测智能体任务完成能力,并非所有场景 Luna 都能持平 Fable 5。但在日常推理和代码生成等高频场景中,降价前的 Luna 本身就已足够出色,降价后更是把门槛拉到了前所未有的低位。
降价不是新闻,降价后还能盈利才是新闻。GPU 内核优化 20% 成本下降、推测性解码 15% 效率提升——这些数字说明推理侧的技术红利正在从实验室走向账单。
对开发者而言,这意味着:构建 AI 应用的边际成本正在快速趋近于零。当入门款 Luna 的单任务成本降到 6 美分,智能体工作流可以从「是否值得用」变成「为什么不直接用」。
但降价也暴露了竞争格局的残酷。OpenAI 选择在此时大幅降价,显然不是单纯为回馈用户,而是为了在模型能力趋同的背景下,用价格优势锁定生态。
模型能力竞争的下半场,定价权正在从「谁更强」转向「谁更便宜且够用」。Luna 降价 80% 不是终点,而是 AI 推理成本指数级下降的又一个里程碑——当成本不再是障碍,阻碍应用落地的瓶颈就只剩一个:开发者的想象力。
降价即日起在 Codex 和 ChatGPT Work 中生效,使用 API 或 ChatGPT 应用即可体验 Luna 的超低推理成本。
登录 OpenAI 平台 → 选择 GPT-5.6 Luna