Claude Sonnet 5 发布:Sonnet 级模型开始承担更长的 Agent 任务

Anthropic 发布 Claude Sonnet 5,强调它是目前最 agentic 的 Sonnet 模型,在工具使用、编码、知识工作、成本效率和安全评估上都有明确边界。

浏览 34
Claude Sonnet 5 发布:Sonnet 级模型开始承担更长的 Agent 任务封面

Anthropic 6 月 30 日发布 Claude Sonnet 5,并把它称为目前最具 agentic 能力的 Sonnet 模型。官方表述的重点很清楚:Sonnet 5 能制定计划,使用浏览器和终端等工具,并以更低成本执行过去需要更大、更贵模型才能完成的自主任务。对 AI Agent 应用来说,这代表中等价位模型正在承担越来越多长链路工作。

Sonnet 级模型向 Opus 能力区间靠近

Anthropic 回顾说,很多开发者最早感受到 Agent 编程能力,是从 Sonnet 3.5、3.6、3.7 开始的。但近一段时间,agentic 能力最明显的提升集中在 Opus 级模型。Sonnet 5 的目标就是缩小这个差距:它在推理、工具使用、编码和知识工作方面明显强于 Sonnet 4.6,并接近 Opus 4.8,但价格更低。

Claude Sonnet 5 与 Sonnet 4.6、Opus 4.8 的评测对比表
Claude Sonnet 5 与 Sonnet 4.6、Opus 4.8 的评测对比表

官方评测表把 Sonnet 5 与 Sonnet 4.6、Opus 4.8 放在一起比较,强调它在多个 Agent 相关任务上更接近旗舰模型。这对实际团队很重要,因为大多数产品不会把每一个 Agent 任务都交给最贵模型。真正可规模化的 Agent 工作流,需要在足够可靠和可承受成本之间找到平衡。

成本效率成为 Agent 模型竞争核心

Anthropic 还用 agentic search 和 computer use 评测比较不同 effort 水平下的成本表现。官方说明,Sonnet 5 在中等 effort 下成本效率显著提升,在更高 effort 下某些任务可以接近 Opus 4.8。发布初期,Sonnet 5 API 价格到 2026 年 8 月 31 日前为每百万输入 token 2 美元、输出 token 10 美元,之后回到每百万输入 3 美元、输出 15 美元。

这说明模型竞争正在从“谁最高分”转向“在特定任务成本下谁更稳定”。Agent 工作流通常不是一次回答,而是计划、读文件、调用工具、修复、验证、再修复的循环。只要上下文变长、工具调用变多,成本和吞吐就会成为产品是否能落地的硬约束。

默认可用范围更广

Sonnet 5 从发布当天开始面向所有计划可用:Free 和 Pro 计划默认使用它,Max、Team、Enterprise 用户也可以使用;Claude Code 和 Claude Platform 同步支持,开发者可通过 claude-sonnet-5 调用 API。Anthropic 还提到,为支持更高 effort 水平带来的 token 用量,Chat、Cowork、Claude Code 和 Claude Platform 的速率限制都有提升。

这类可用范围会直接影响生态扩散速度。如果一个模型只在少数高级计划里可用,它更像能力展示;如果它成为免费和 Pro 用户的默认模型,它就会更快进入日常编码、文档、数据分析和办公自动化场景。

安全评估没有被放在边缘

Anthropic 在公告中专门写了安全评估。官方称,Sonnet 5 整体比 Sonnet 4.6 更安全,在 agentic safety 上更会拒绝恶意请求,也更能抵抗 prompt injection hijack;幻觉和 sycophancy 比 Sonnet 4.6 更低。不过它在某些自动化 misaligned behavior 审计中的表现,仍比更强的 Opus 4.8 和 Claude Mythos Preview 更高。

Claude 不同模型在 misaligned behavior 自动审计中的比例对比
Claude 不同模型在 misaligned behavior 自动审计中的比例对比

在网络安全能力方面,Anthropic 表示没有刻意把 Sonnet 5 训练成网络安全模型。它可以做一些常规、无害的 cyber 任务,但在开发软件漏洞利用等危险能力评估上明显弱于 Opus 4.8 和 Mythos 5。

Claude 模型在 Firefox 漏洞利用评估中的结果
Claude 模型在 Firefox 漏洞利用评估中的结果

公告还提到,在一个针对 Firefox 147 漏洞利用能力的评估中,Sonnet 级模型没有成功开发完整可运行 exploit,但 Sonnet 5 的部分成功率略高于 Sonnet 4.6。Anthropic 因此默认开启 cyber safeguards,只是严格程度低于 Fable 5 那类更高风险模型。

对开发者的现实含义

Sonnet 5 的发布不是单纯模型升级,而是一个信号:Agent 产品会越来越多地用“中高能力、可控成本、默认可用”的模型做主执行层,把更贵的旗舰模型留给高难度判断或关键节点。对使用 Codex、Claude Code、Copilot 等工具的团队来说,选模型不再只是看榜单,而是要看任务类型、工具调用强度、预算、权限边界和安全要求。

如果 Sonnet 级模型能稳定承担更多长链路任务,开发团队可以把它用在代码迁移、持续修复、知识库整理、流程自动化和多工具协作上。但官方评估也提醒,越 agentic 的模型越需要清晰的权限、日志、沙箱和人工验收。Agent 能跑得更远,不代表它应该在没有边界的环境里跑。

参考来源

本文为公开资料整理与技术学习参考,不提供采编、转载或发布服务。

34