Anthropic 暂停 Fable 5 与 Mythos 5 访问,前沿模型安全与可用性正面冲突
Anthropic 在发布 Claude Fable 5 和 Mythos 5 数日后,因美国政府指令暂停访问,直接把前沿模型的安全策略、监管压力和可用性冲突摆到台面上。
Anthropic 暂停 Fable 5 与 Mythos 5 访问:高能力模型上线后的安全争议
Anthropic 在 2026 年 6 月 12 日发布声明称,因收到美国政府基于国家安全权限发出的出口管制指令,公司必须暂停所有客户对 Claude Fable 5 和 Claude Mythos 5 的访问。Anthropic 表示,这一暂停适用于所有客户,同时也包括美国境内外的外籍人员以及 Anthropic 内部外籍员工;其他 Anthropic 模型不受影响。
这距离 Anthropic 在 6 月 9 日发布 Claude Fable 5 和 Claude Mythos 5 只有数日。按照此前发布说明,Fable 5 是一个面向更广泛用户开放的 Mythos-class 模型,Mythos 5 则面向少量网络防御者和基础设施提供方,初期通过 Project Glasswing 部署。
指令在发布后三天到来,访问被整体暂停
Anthropic 在声明中写到,公司在当天美国东部时间 5:21pm 收到政府指令。信件没有提供具体国家安全关切细节。Anthropic 表示,其理解是政府认为已经获知一种绕过或 jailbreak Fable 5 的方法。
按照 Anthropic 的说法,公司审查了该技术演示,认为它被用于识别少量已知、较轻微的软件漏洞;这些漏洞相对简单,其他公开可用模型也能在不绕过防护的情况下发现。
Anthropic 的公开立场是:公司会遵守法律指令,并为所有用户移除 Fable 5 和 Mythos 5 访问;但 Anthropic 同时表示,不认同仅因一个范围较窄的潜在 jailbreak,就召回已经面向大量用户部署的商业模型。
Fable 5 原本定位为更广泛可用的 Mythos-class 模型
在 6 月 9 日的发布说明中,Anthropic 将 Claude Fable 5 描述为一个经过安全处理、可面向通用使用的 Mythos-class 模型。Anthropic 称,Fable 5 在软件工程、知识工作、视觉、科学研究等多项测试中表现突出,任务越长、越复杂,相比 Anthropic 其他模型的领先越明显。
同一篇发布说明中,Anthropic 也解释了为什么需要额外防护。Fable 5 在网络安全等领域的能力可能被误用,因此 Anthropic 为它设置了防护机制。当请求涉及某些敏感主题时,系统会改由 Claude Opus 4.8 响应。Anthropic 表示这些防护被调得较保守,有时会拦截无害请求,但平均触发比例低于 5% 的会话。
Mythos 5 则是同一底层模型,但在部分领域去除了防护,初期面向更受控的网络防御和关键基础设施场景。Anthropic 称,Mythos 5 具备公司最强的网络安全能力,并计划之后通过更广泛的可信访问项目扩大使用范围。
争议集中在 jailbreak 与防护标准
Anthropic 在 6 月 12 日声明中重点解释了 Fable 5 的安全立场。公司称,发布前曾与美国政府、英国 AISI、多个第三方组织和内部团队对 Fable 的防护进行数千小时红队测试。
Anthropic 表示,测试显示 Fable 的防护比此前部署模型更有效,目前没有测试者找到能够广泛绕过模型防护的 universal jailbreak。公司也承认,目前行业内可能没有任何模型供应商能做到“完美抗 jailbreak”,因此 Fable 5 采用的是 defense in depth 策略:让狭义 jailbreak 影响范围尽量小,让广义 jailbreak 生产成本尽量高,并结合监控机制发现和阻断攻击。
这也是 Anthropic 要求 Fable 保留客户数据 30 天的原因。公司在声明中称,30 天数据保留会带来真实客户成本,但有助于研究和缓解 jailbreak。
这次事件暴露的是“能力开放”与“安全阈值”的冲突
从两篇官方文本合在一起看,Fable 5 与 Mythos 5 的争议点并不只是某个模型是否足够强,而是高能力模型在开放、可用、安全和监管之间的边界如何确定。
Anthropic 一方面希望把 Mythos-class 能力更快带给更多用户,另一方面又通过分类器、降级响应、数据保留和红队测试来降低误用风险。政府指令则把另一套判断引入进来:即便模型公司认为风险可以通过分层防护和监控处理,外部监管也可能要求直接暂停访问。
对企业用户来说,这类事件的实际影响很明确:选择前沿模型时,不能只看基准表现、上下文能力和价格,还要关注访问条件、数据保留要求、可用性变化、区域或身份限制,以及模型在第三方平台中的下线风险。
参考来源
本文为公开资料整理与技术学习参考,不提供采编、转载或发布服务。
Copilot 代码审查接入 Agent Skills 与只读 MCP:团队规则如何进入 PR
GitHub 将 Copilot 代码审查中的 Agent Skills 与 MCP 支持从公开预览推进到正式可用,让任务型审查规则和问题跟踪、文档、服务目录等外部上下文进入 PR;但只读调用、评论归因和人工门禁仍有明确边界。
MCP 2026-07-28 转向无状态:GitHub Server 提前适配了什么
MCP 2026-07-28 稳定规范移除了协议会话与 initialize 握手,把连接上下文放回每次请求;GitHub MCP Server 的提前适配展示了无状态服务的工程收益,也说明兼容仍依赖版本协商、旧协议回退和一致性测试。
Copilot App 使用数据进入标准报表:能衡量采用,不能直接证明 ROI
GitHub 把 Copilot App 活动纳入企业、组织和用户级标准使用度量,新增用户活跃、会话、请求、Token、模型、语言与代码活动拆分;这些指标适合观察采用与覆盖,不应单独解释为生产力或 ROI。