🚀 模型 · 发布速递

中端线逼近旗舰:Claude Sonnet 5 发布,多项 Agent 评测追平 Opus 4.8

6 月 30 日,Anthropic 发布 Claude Sonnet 5,定位"迄今最强 Agent 型 Sonnet"。在智能体搜索 BrowseComp 与计算机操作 OSWorld 两项基准上,中档 effort 下即可覆盖 Sonnet 4.6 无法触及的成本-性能区间,高 effort 下部分任务追平 Opus 4.8——而输入价格仅为后者的 60%。

来源:官方发布 2026-06-30 全文约 4 分钟读完
#ClaudeSonnet5 #Anthropic #AI Agent #模型发布
$2/M introductory 输入价 · 8 月 31 日后转 $3
60% 输入价为 Opus 4.8($5/M)的六成
≈ Opus 4.8 高 effort 下部分任务性能持平旗舰

⚡ 30 秒速览

  • 定位:Agent 型 Sonnet——能规划、能调浏览器与终端、能自主跑完多步任务,过去需 Opus 级别才能胜任。
  • 性能跃迁:对比上代 Sonnet 4.6,在推理、工具使用、编码、知识工作四个维度显著提升;在 BrowseComp 与 OSWorld 上构成对 4.6 的"严格改进"。
  • 价格策略:introductory 期 $2/$10(每百万 input/output token),9 月起转标准价 $3/$15;Opus 4.8 为 $5/$25。
  • 安全取舍:整体更安全(幻觉、谄媚、被劫持率均降),但未做网络安全训练,且默认开启 cyber safeguards。
  • 可用范围:Free / Pro / Max / Team / Enterprise 全档位上线,同时进入 Claude Code 与 API。

01旗舰能力下放,中端价吃旗舰性能

过去数月,Anthropic 的 Agent 能力跃升主要集中在 Opus 级旗舰上。Sonnet 5 的核心叙事是把这条能力曲线压到中端价位——官方明确表述为"性能接近 Opus 4.8,但价格更低"。

关键证据来自两项 Agent 基准的成本-性能曲线(横轴为单任务成本,纵轴为成功率):

Sonnet 4.6(上代)

曲线明显低于 Opus 4.8,在两项基准上均"远未达到"旗舰水平。

Sonnet 5(本次)

构成对 4.6 的严格改进——同成本下成功率更高,同成功率下成本更低。

vs Opus 4.8(旗舰)

中 effort 下成本效率大幅领先;高 effort 下部分任务追平 Opus 4.8。

注:以上为官方成本-性能曲线的文字概括,曲线图基于 $3/$15 标准价绘制;introductory 期实际成本更低。Anthropic 同时提供了 effort 参数(低→xhigh),开发者可在成本与性能间自主调节。

02实测反馈:从"跑到一半就停"到"端到端交付"

Anthropic 公布了十余家早期合作方的反馈,核心信号高度一致:Sonnet 5 不再在复杂任务中途停摆,而是自主跑到可验证的终点

🔧 Salesforce 双步任务:更新账户分级 + 群发公告端到端

  • 过去 Sonnet 级模型会在这种跨系统双步任务中段停滞。
  • Sonnet 5 接手后从头跑到尾,完成账户分级更新与企业联系人公告发送。
"它完成了端到端。这以前会卡在半路。日常自动化,这是不二之选。"

🐛 自主 Bug 调查:写复现测试 → 修 → 验证回归无需提示

  • 测试者仅说了一句"调查这个 bug",未给任何步骤指令
  • Sonnet 5 自主完成:写复现测试 → 实现修复 → stash 改动确认 bug 回归 → 全程单次通过。
"未被提示,它自己写了复现测试、实现修复、然后 stash 改动来确认 bug 会在没有这个改动时回来。"

🏗️ 棕地代码:专啃"没人想碰的角落"根因修复

  • 竞态条件、隐藏测试、历史包袱等棕地场景表现最佳。
  • 追溯到真实根因并交付持久修复,而非打补丁式掩盖症状。
"它追踪失败到真正的根因,交付一个持久的修复,而不是修补症状。"

⚖️ 法律研究:原告方任务上占据帕累托前沿迁移决策

  • Eve 报告:Sonnet 5 在原告方法律任务上占据帕累托前沿(同成本下性能最优 / 同性能下成本最优)。
  • 在法律研究与分析维度增益最清晰,性价比直接促成迁移决策

03安全账本:更难被劫持,但主动放弃网络安全能力

Anthropic 在 System Card 中披露了一组非对称的安全取舍——在 Agent 语境下更安全,但刻意不训练网络安全技能:

✅ 向好的方向

拒绝恶意请求、抵抗 prompt 注入劫持的能力均提升;幻觉率与谄媚率下降;自动化行为审计中整体不当行为率低于 4.6。

⚠️ 刻意削弱

未做网络安全训练。在 Firefox 漏洞利用评测中,Sonnet 5 无法开发完整可用的 exploit(0%),部分成功率略高于 4.6——Anthropic 将此归因于通用智能提升而非专项训练。

配套措施:因 Sonnet 5 在网络任务上略强于上代,默认开启 cyber safeguards(与 Opus 4.7/4.8 同款实时拦截)。需要无护栏网络安全工作的用户,官方仍推荐使用 Opus 4.8。

注:行为审计显示,Sonnet 5 的不当行为率略高于 Opus 4.8 与 Mythos Preview——即更安全但非最安全。完整数据见 System Card 第 6.4 节。

编辑视角

来源立场提示:本文几乎全部数据与引语来自 Anthropic 官方发布与 System Card,属典型的企业通稿+自评测口径。成本-性能曲线、安全审计、合作方反馈均未见第三方独立复测;尤其"追平 Opus 4.8"的结论基于官方选定的基准与 effort 参数设定,读者宜将其理解为厂商自证的上限声明而非中立结论。

怎么读这组数据:Sonnet 5 的真正新闻眼不是"又强了一点",而是旗舰与中端的性能差正在被价格差更快地稀释——当 $2/M 的模型在高 effort 下能触及 $5/M 旗舰的曲线,"按需调档"将成为 Agent 开发的新默认范式。安全端的非对称取舍(更难劫持 + 主动弃权网络攻击能力 + 默认护栏)则预示了行业监管的一个可能走向:能力前沿的推进将越来越多地与"主动不做什么"绑定。

当旗舰能力可以被中端价格"够到",模型竞争的主战场将从参数上限转向 effort 调节空间与单位成本下的可用任务边界。

现在就能用

Sonnet 5 已在 Free / Pro / Max / Team / Enterprise 全档位上线,同步进入 Claude Code 与 Claude API。

claude.ai → 或 API: claude-sonnet-5
introductory 定价(至 2026-08-31):$2/M input · $10/M output
标准定价(9 月起):$3/M input · $15/M output · 对比 Opus 4.8:$5/M input · $25/M output