Anthropic 发布 Claude Fable 5 和 Mythos 5,前沿能力与安全限制并行

Anthropic 推出 Claude Fable 5 和 Claude Mythos 5,强调面向最难知识工作和编码问题的新一代能力。

浏览 34
Anthropic 发布 Claude Fable 5 和 Mythos 5,前沿能力与安全限制并行封面

Anthropic 发布 Claude Fable 5 与 Mythos 5:同一底座,两种开放方式

Anthropic 发布 Claude Fable 5 和 Claude Mythos 5,把 Mythos-class 模型能力分成两种开放路径。按照官方说明,Fable 5 是一个面向更广泛用户开放、带有新安全护栏的 Mythos-class 模型;Mythos 5 则使用同一底层模型,但在部分领域移除防护,初期面向少量网络防御者和关键基础设施提供方。

Anthropic 在发布中强调,这两个模型能够比此前 Claude 模型更长时间自主工作,覆盖软件工程、知识工作、视觉、记忆和生命科学研究等方向。两者定价均为每百万 input tokens 10 美元、每百万 output tokens 50 美元,低于 Claude Mythos Preview 的一半。

Fable 5 面向更广泛使用,Mythos 5 走可信访问

Anthropic 对 Fable 5 和 Mythos 5 的区分,不是能力底座不同,而是访问方式和安全边界不同。

Fable 5 面向今天即可使用的更广泛场景,开发者可以通过 Claude API 使用 claude-fable-5。Anthropic 将它定位为把 Mythos-level 能力带给更多用户的版本,但同时为网络安全和生物化学等敏感方向设置了更严格防护。

Mythos 5 则限制在更小范围。Anthropic 表示,所有已有 Claude Mythos Preview 权限的用户,例如 Project Glasswing 中的网络安全伙伴,可以升级到 Mythos 5。它和 Fable 5 是同一底层模型,但网络安全防护在部分场景中被解除;后续 Anthropic 计划通过 broader trusted access program 扩大访问。

Benchmark 表格展示了模型能力位置

原文中给出了一张 benchmark 对比表,用来展示 Claude Fable 5 和 Claude Mythos 5 与其他领先模型的能力位置。

Claude Fable 5 与 Mythos 5 的 benchmark 对比表
Claude Fable 5 与 Mythos 5 的 benchmark 对比表

Anthropic 在表格后说明,Fable 5 和 Mythos 5 能够比此前 Claude 模型更长时间自主工作。它们在软件工程、知识工作、视觉、记忆和生命科学研究中表现更强,尤其适合长程任务和复杂任务。

这张表的意义不只是显示分数,而是为后文的多个能力章节做铺垫:Anthropic 并没有只把 Fable 5 描述成聊天模型升级,而是把它放在更长程的 agentic work 中衡量。

软件工程和长程编码是 Fable 5 的主战场

在软件工程部分,Anthropic 引用 Stripe 的早期测试反馈称,Fable 5 将数月工程工作压缩到数天;在一个 5,000 万行 Ruby 代码库中,模型一天内完成了原本需要一个团队手工两个月以上的大范围迁移。

Anthropic 还提到,在 Cognition 的 FrontierCode 评估中,Fable 5 在 frontier models 中得分最高,即使在 medium effort 下也表现突出。FrontierCode 关注模型是否能在高质量生产代码库标准下完成困难编码任务。

Claude Fable 5 在 FrontierCode 软件工程评估中的表现
Claude Fable 5 在 FrontierCode 软件工程评估中的表现

这些信息说明,Fable 5 的主要卖点不是单次代码生成,而是长程自主编码能力:理解大型代码库、持续调用工具、保持任务目标,并在复杂迁移或生产级任务中减少 token 和工具调用成本。

Mythos 5 更突出受控研究和生命科学任务

Mythos 5 的重点在于受控访问下的高能力使用。Anthropic 称,Mythos 5 在网络安全方面具备全球最强能力,并通过 Project Glasswing 面向网络防御者和基础设施提供者部署。

在生命科学部分,Anthropic 提到内部蛋白质设计专家使用 Mythos 5 将药物设计流程的部分环节加速约 10 倍。在一个示例中,Mythos 5 结合蛋白质设计和生物信息学工具,在没有人类辅助的情况下完成通常由科学家执行的任务,包括选择结合位点、选择并运行蛋白质设计工具,以及从失败中恢复。

Mythos 5 设计的蛋白质复合物目标示例
Mythos 5 设计的蛋白质复合物目标示例

原文还提到,Mythos 5 可以提出新的分子生物学假设,并在基因组学研究中自主整理数百万细胞、覆盖 138 个动物物种的数据,训练一个小得多的模型来识别不同物种中执行同一角色的细胞。

安全护栏和 30 天数据保留是发布的重要组成部分

Anthropic 在原文中用大量篇幅解释 Fable 5 的安全护栏。公司表示,Mythos-class 模型能力已经达到会带来显著风险的阈值,因此 Fable 5 采用多层防护。

其中包括针对网络安全与生物化学领域的 safeguards。当请求触及某些敏感领域时,系统可能把响应降级到 Claude Opus 4.8 或其他较低风险模型。Anthropic 也承认,这些防护有时会带来 false positives,但在测试中平均触发比例低于 5% 的会话。

Anthropic 对 Fable 5 与 Mythos 5 的自动化 alignment assessment
Anthropic 对 Fable 5 与 Mythos 5 的自动化 alignment assessment

原文还说明,Anthropic 将对 Fable 5、Mythos 5 以及未来类似或更高能力模型的商业客户流量要求 30 天数据保留。这些数据不会用于训练新 Claude 模型,也不会用于非安全目的;Anthropic 称其会帮助防御复杂的新型攻击,包括跨多请求的 jailbreak 和攻击,同时用于减少误报。

这次发布的核心不是单一模型升级

这篇发布真正值得关注的,是 Anthropic 如何处理“前沿能力开放”与“安全限制”之间的关系。Fable 5 和 Mythos 5 使用同一模型底座,但根据用户范围、任务风险和访问控制被拆成不同产品路径。

对普通开发者和企业团队来说,Fable 5 代表更强的长程编码、知识工作和视觉能力;对受控安全与科研场景来说,Mythos 5 则代表更高能力但更严格访问边界。与其把它看成一次普通模型发布,不如把它看成 Anthropic 对高能力模型分层开放方式的一次试验。

参考来源

本文为公开资料整理与技术学习参考,不提供采编、转载或发布服务。

34