中端线逼近旗舰:Claude Sonnet 5 发布,多项 Agent 评测追平 Opus 4.8
6 月 30 日,Anthropic 发布 Claude Sonnet 5,定位"迄今最强 Agent 型 Sonnet"。在智能体搜索 BrowseComp 与计算机操作 OSWorld 两项基准上,中档 effort 下即可覆盖 Sonnet 4.6 无法触及的成本-性能区间,高 effort 下部分任务追平 Opus 4.8——而输入价格仅为后者的 60%。
6 月 30 日,Anthropic 发布 Claude Sonnet 5,定位"迄今最强 Agent 型 Sonnet"。在智能体搜索 BrowseComp 与计算机操作 OSWorld 两项基准上,中档 effort 下即可覆盖 Sonnet 4.6 无法触及的成本-性能区间,高 effort 下部分任务追平 Opus 4.8——而输入价格仅为后者的 60%。
过去数月,Anthropic 的 Agent 能力跃升主要集中在 Opus 级旗舰上。Sonnet 5 的核心叙事是把这条能力曲线压到中端价位——官方明确表述为"性能接近 Opus 4.8,但价格更低"。
关键证据来自两项 Agent 基准的成本-性能曲线(横轴为单任务成本,纵轴为成功率):
曲线明显低于 Opus 4.8,在两项基准上均"远未达到"旗舰水平。
构成对 4.6 的严格改进——同成本下成功率更高,同成功率下成本更低。
中 effort 下成本效率大幅领先;高 effort 下部分任务追平 Opus 4.8。
注:以上为官方成本-性能曲线的文字概括,曲线图基于 $3/$15 标准价绘制;introductory 期实际成本更低。Anthropic 同时提供了 effort 参数(低→xhigh),开发者可在成本与性能间自主调节。
Anthropic 公布了十余家早期合作方的反馈,核心信号高度一致:Sonnet 5 不再在复杂任务中途停摆,而是自主跑到可验证的终点。
Anthropic 在 System Card 中披露了一组非对称的安全取舍——在 Agent 语境下更安全,但刻意不训练网络安全技能:
拒绝恶意请求、抵抗 prompt 注入劫持的能力均提升;幻觉率与谄媚率下降;自动化行为审计中整体不当行为率低于 4.6。
未做网络安全训练。在 Firefox 漏洞利用评测中,Sonnet 5 无法开发完整可用的 exploit(0%),部分成功率略高于 4.6——Anthropic 将此归因于通用智能提升而非专项训练。
配套措施:因 Sonnet 5 在网络任务上略强于上代,默认开启 cyber safeguards(与 Opus 4.7/4.8 同款实时拦截)。需要无护栏网络安全工作的用户,官方仍推荐使用 Opus 4.8。
注:行为审计显示,Sonnet 5 的不当行为率略高于 Opus 4.8 与 Mythos Preview——即更安全但非最安全。完整数据见 System Card 第 6.4 节。
来源立场提示:本文几乎全部数据与引语来自 Anthropic 官方发布与 System Card,属典型的企业通稿+自评测口径。成本-性能曲线、安全审计、合作方反馈均未见第三方独立复测;尤其"追平 Opus 4.8"的结论基于官方选定的基准与 effort 参数设定,读者宜将其理解为厂商自证的上限声明而非中立结论。
怎么读这组数据:Sonnet 5 的真正新闻眼不是"又强了一点",而是旗舰与中端的性能差正在被价格差更快地稀释——当 $2/M 的模型在高 effort 下能触及 $5/M 旗舰的曲线,"按需调档"将成为 Agent 开发的新默认范式。安全端的非对称取舍(更难劫持 + 主动弃权网络攻击能力 + 默认护栏)则预示了行业监管的一个可能走向:能力前沿的推进将越来越多地与"主动不做什么"绑定。
Sonnet 5 已在 Free / Pro / Max / Team / Enterprise 全档位上线,同步进入 Claude Code 与 Claude API。
claude.ai → 或 API: claude-sonnet-5