Anthropic 发布 Claude Fable 5 和 Mythos 5,前沿能力与安全限制并行
Anthropic 推出 Claude Fable 5 和 Claude Mythos 5,强调面向最难知识工作和编码问题的新一代能力。
Anthropic 发布 Claude Fable 5 与 Mythos 5:同一底座,两种开放方式
Anthropic 发布 Claude Fable 5 和 Claude Mythos 5,把 Mythos-class 模型能力分成两种开放路径。按照官方说明,Fable 5 是一个面向更广泛用户开放、带有新安全护栏的 Mythos-class 模型;Mythos 5 则使用同一底层模型,但在部分领域移除防护,初期面向少量网络防御者和关键基础设施提供方。
Anthropic 在发布中强调,这两个模型能够比此前 Claude 模型更长时间自主工作,覆盖软件工程、知识工作、视觉、记忆和生命科学研究等方向。两者定价均为每百万 input tokens 10 美元、每百万 output tokens 50 美元,低于 Claude Mythos Preview 的一半。
Fable 5 面向更广泛使用,Mythos 5 走可信访问
Anthropic 对 Fable 5 和 Mythos 5 的区分,不是能力底座不同,而是访问方式和安全边界不同。
Fable 5 面向今天即可使用的更广泛场景,开发者可以通过 Claude API 使用 claude-fable-5。Anthropic 将它定位为把 Mythos-level 能力带给更多用户的版本,但同时为网络安全和生物化学等敏感方向设置了更严格防护。
Mythos 5 则限制在更小范围。Anthropic 表示,所有已有 Claude Mythos Preview 权限的用户,例如 Project Glasswing 中的网络安全伙伴,可以升级到 Mythos 5。它和 Fable 5 是同一底层模型,但网络安全防护在部分场景中被解除;后续 Anthropic 计划通过 broader trusted access program 扩大访问。
Benchmark 表格展示了模型能力位置
原文中给出了一张 benchmark 对比表,用来展示 Claude Fable 5 和 Claude Mythos 5 与其他领先模型的能力位置。

Anthropic 在表格后说明,Fable 5 和 Mythos 5 能够比此前 Claude 模型更长时间自主工作。它们在软件工程、知识工作、视觉、记忆和生命科学研究中表现更强,尤其适合长程任务和复杂任务。
这张表的意义不只是显示分数,而是为后文的多个能力章节做铺垫:Anthropic 并没有只把 Fable 5 描述成聊天模型升级,而是把它放在更长程的 agentic work 中衡量。
软件工程和长程编码是 Fable 5 的主战场
在软件工程部分,Anthropic 引用 Stripe 的早期测试反馈称,Fable 5 将数月工程工作压缩到数天;在一个 5,000 万行 Ruby 代码库中,模型一天内完成了原本需要一个团队手工两个月以上的大范围迁移。
Anthropic 还提到,在 Cognition 的 FrontierCode 评估中,Fable 5 在 frontier models 中得分最高,即使在 medium effort 下也表现突出。FrontierCode 关注模型是否能在高质量生产代码库标准下完成困难编码任务。

这些信息说明,Fable 5 的主要卖点不是单次代码生成,而是长程自主编码能力:理解大型代码库、持续调用工具、保持任务目标,并在复杂迁移或生产级任务中减少 token 和工具调用成本。
Mythos 5 更突出受控研究和生命科学任务
Mythos 5 的重点在于受控访问下的高能力使用。Anthropic 称,Mythos 5 在网络安全方面具备全球最强能力,并通过 Project Glasswing 面向网络防御者和基础设施提供者部署。
在生命科学部分,Anthropic 提到内部蛋白质设计专家使用 Mythos 5 将药物设计流程的部分环节加速约 10 倍。在一个示例中,Mythos 5 结合蛋白质设计和生物信息学工具,在没有人类辅助的情况下完成通常由科学家执行的任务,包括选择结合位点、选择并运行蛋白质设计工具,以及从失败中恢复。

原文还提到,Mythos 5 可以提出新的分子生物学假设,并在基因组学研究中自主整理数百万细胞、覆盖 138 个动物物种的数据,训练一个小得多的模型来识别不同物种中执行同一角色的细胞。
安全护栏和 30 天数据保留是发布的重要组成部分
Anthropic 在原文中用大量篇幅解释 Fable 5 的安全护栏。公司表示,Mythos-class 模型能力已经达到会带来显著风险的阈值,因此 Fable 5 采用多层防护。
其中包括针对网络安全与生物化学领域的 safeguards。当请求触及某些敏感领域时,系统可能把响应降级到 Claude Opus 4.8 或其他较低风险模型。Anthropic 也承认,这些防护有时会带来 false positives,但在测试中平均触发比例低于 5% 的会话。

原文还说明,Anthropic 将对 Fable 5、Mythos 5 以及未来类似或更高能力模型的商业客户流量要求 30 天数据保留。这些数据不会用于训练新 Claude 模型,也不会用于非安全目的;Anthropic 称其会帮助防御复杂的新型攻击,包括跨多请求的 jailbreak 和攻击,同时用于减少误报。
这次发布的核心不是单一模型升级
这篇发布真正值得关注的,是 Anthropic 如何处理“前沿能力开放”与“安全限制”之间的关系。Fable 5 和 Mythos 5 使用同一模型底座,但根据用户范围、任务风险和访问控制被拆成不同产品路径。
对普通开发者和企业团队来说,Fable 5 代表更强的长程编码、知识工作和视觉能力;对受控安全与科研场景来说,Mythos 5 则代表更高能力但更严格访问边界。与其把它看成一次普通模型发布,不如把它看成 Anthropic 对高能力模型分层开放方式的一次试验。
参考来源
本文为公开资料整理与技术学习参考,不提供采编、转载或发布服务。
Copilot 代码审查接入 Agent Skills 与只读 MCP:团队规则如何进入 PR
GitHub 将 Copilot 代码审查中的 Agent Skills 与 MCP 支持从公开预览推进到正式可用,让任务型审查规则和问题跟踪、文档、服务目录等外部上下文进入 PR;但只读调用、评论归因和人工门禁仍有明确边界。
MCP 2026-07-28 转向无状态:GitHub Server 提前适配了什么
MCP 2026-07-28 稳定规范移除了协议会话与 initialize 握手,把连接上下文放回每次请求;GitHub MCP Server 的提前适配展示了无状态服务的工程收益,也说明兼容仍依赖版本协商、旧协议回退和一致性测试。
Copilot App 使用数据进入标准报表:能衡量采用,不能直接证明 ROI
GitHub 把 Copilot App 活动纳入企业、组织和用户级标准使用度量,新增用户活跃、会话、请求、Token、模型、语言与代码活动拆分;这些指标适合观察采用与覆盖,不应单独解释为生产力或 ROI。