Claude Sonnet 4.6 发布,强调更适合日常工作流的 Claude 模型

Anthropic 在 2 月发布 Claude Sonnet 4.6,延续 Claude 在办公、代码和多步骤任务中的实用定位。

浏览 19
Claude Sonnet 4.6 发布,强调更适合日常工作流的 Claude 模型封面

Claude Sonnet 4.6 发布:主力模型升级到 1M 上下文和更强日常工作流

Anthropic 在 2026 年 2 月 17 日发布 Claude Sonnet 4.6,并称其为目前最强的 Sonnet 模型。按照官方说明,Sonnet 4.6 在编码、电脑使用、长上下文推理、agent planning、知识工作和设计能力上都有完整升级,同时提供 1M token context window beta。

这次发布的一个关键信息是,Sonnet 4.6 已成为 Free 和 Pro 用户在 claude.ai 与 Claude Cowork 中的默认模型。价格保持与 Sonnet 4.5 相同,起价为每百万 input tokens 3 美元、每百万 output tokens 15 美元。

Sonnet 4.6 承担的是主力模型角色

Anthropic 对 Sonnet 4.6 的定位和 Opus 系列不同。Opus 更偏旗舰能力,Sonnet 则更接近日常高频使用。原文强调,Sonnet 4.6 把过去可能需要 Opus-class 模型才能完成的一部分真实工作能力,带到了更广泛用户可以默认使用的模型上。

在编码方面,Anthropic 表示 Sonnet 4.6 相比 Sonnet 4.5 有明显提升。早期开发者更偏好 Sonnet 4.6,有时甚至会选择它而不是 2025 年 11 月的 Claude Opus 4.5。

这说明 Sonnet 4.6 的价值不是单纯“更便宜”,而是让许多原本需要更高成本模型的任务,进入主力模型可承接范围。

电脑使用能力继续推进旧系统自动化

Anthropic 在原文中特别展开了 computer use。它指出,几乎每个组织都有一些难以自动化的软件:专用系统、旧工具、没有现代 API 的界面。过去如果要让 AI 使用这些系统,通常需要构建定制 connector;但如果模型能像人一样使用电脑,问题会发生变化。

Anthropic 回顾称,公司在 2024 年 10 月率先推出通用电脑使用模型,当时能力仍然实验性较强、笨拙且容易出错;Sonnet 4.6 则继续推进这一方向。原文提到,OSWorld 这类标准 benchmark 用 Chrome、LibreOffice、VS Code 等真实软件任务测试 AI 的电脑使用能力。

这对企业工作流有实际意义。许多组织的自动化障碍并不在模型本身,而在系统老旧、接口不统一、流程分散。电脑使用能力让模型可以直接操作界面,从而覆盖那些暂时无法 API 化的任务。

编码和企业文档场景是主要落点

Sonnet 4.6 的早期测试反馈覆盖多个开发和企业工作场景。GitHub 反馈提到,Sonnet 4.6 在复杂代码修复上表现突出,尤其是需要跨大型代码库搜索时;Cognition 则表示,Sonnet 4.6 在 bug detection 上明显缩小了与 Opus 的差距,可以并行运行更多 reviewer,在不增加成本的情况下捕获更多类型的 bug。

Box 的反馈则强调,Sonnet 4.6 在真实企业文档上的 deep reasoning 和 complex agentic tasks 中表现更好,在 heavy reasoning Q&A 上相比 Sonnet 4.5 提升 15 个百分点。Zapier 的反馈也提到,它在 contract routing、conditional template selection 和 CRM coordination 等分支、多步骤任务上更强。

这些例子说明,Sonnet 4.6 的主要落点不是单一聊天,而是编码、文档、业务系统和跨工具流程。它更像一个面向日常组织工作的主力模型。

1M 上下文和安全评估补齐长任务边界

Sonnet 4.6 同样提供 1M token context window beta。这让它可以处理更长文档、更大代码库、更复杂的多步骤任务。结合 agent planning 和知识工作能力,它适合承担持续时间更长、上下文更重的任务。

Anthropic 也强调,Sonnet 4.6 经过 extensive safety evaluations,整体安全性与近期其他 Claude 模型相当或更好。安全研究团队认为它具有温暖、诚实、亲社会的特征,并且没有显示出严重高风险 misalignment 问题。

对主力模型来说,这类安全评估尤其重要。Sonnet 4.6 面向更广泛用户和更高频任务,稳定性、指令遵循、安全表现和成本控制,都会比单点能力更影响实际采用。

这次发布的实际看点

Sonnet 4.6 的意义在于,把编码、电脑使用、长上下文、agent planning、知识工作和设计能力放进了更广泛用户默认可用的模型层。它不是 Anthropic 最强模型,但可能是更多人日常真正会频繁使用的模型。

对企业和个人用户来说,这意味着 AI 工作流的门槛继续降低。很多日常任务不一定需要旗舰 Opus,只要主力模型能稳定处理代码修复、文档问答、电脑操作、CRM 协调、合同流转和多步骤分析,就足以改变实际工作方式。

后续更值得观察的是,Sonnet 4.6 在真实长任务中的稳定性、电脑使用的可靠性,以及它和 Claude Cowork、Claude Code、企业文档系统之间的结合程度。

参考来源

本文为公开资料整理与技术学习参考,不提供采编、转载或发布服务。

19