跳到正文
Anthropic News·· 2026-06-12精选AI 评分88

Anthropic 就美国政府要求暂停 Fable 5 与 Mythos 5 访问发表声明

Statement on the US government directive to suspend access to Fable 5 and Mythos 5

AI 导读

Anthropic 称美国政府以国家安全为由发出出口管制指令,要求暂停所有外国国民对 Fable 5 和 Mythos 5 的访问,包括其外籍员工,公司因此须对所有客户停用这两款模型,其他模型不受影响。

推荐理由

Anthropic 公开说明被要求下架模型的经过与自身安全测试结论,读者可据此了解前沿模型出口管制的一次具体执行。

正文 · AI 翻译

美国政府以国家安全权力为由,发布了一项出口管制指令,要求暂停任何外国国民对 Fable 5 和 Mythos 5 的所有访问,无论其身处美国境内还是境外,包括 Anthropic 的外国国民员工。该命令的实际效果是,为确保合规,我们必须突然对所有客户禁用 Fable 5 和 Mythos 5。对 Anthropic 所有其他模型的访问不会受到影响。

我们于今天下午 5:21(美国东部时间)收到政府的指令。信中并未提供其国家安全关切的具体细节。我们的理解是,政府认为其已获悉一种绕过或“越狱”Fable 5 的方法。我们审查了该特定技术的演示,其被用于识别少量此前已知的轻微漏洞。这些漏洞看起来都相对简单,并且我们发现其他公开可用的模型无需绕过也能发现它们。

Anthropic 对 Fable 安全保障措施的立场,正如我们在发布博客文章中所述,如下:

  • 我们已实施强有力的安全保障措施,大幅降低了 Fable 被滥用于网络安全(及其他)相关任务的可能性。事实上,我们的保障措施如此严格,以至于许多用户抱怨其范围过于宽泛。
  • 在 Fable 发布前的数周内,Anthropic 与美国政府、英国 AISI、多家私营第三方组织以及内部团队合作,对 Fable 的安全保障措施进行了总计数千小时的红队测试。
  • 这些测试表明,Fable 的安全保障措施比任何此前部署的模型都有效得多。
  • 目前尚无测试者能够找到通用越狱——一种能够非常广泛地绕过模型安全保障措施、解锁广泛网络能力的越狱方法。
  • 我们怀疑,目前任何模型提供商都不可能实现完美的越狱抵抗能力。业界使用的每一种安全保障措施都容易受到非通用越狱的影响(在特定情况下可以引出部分网络信息),并且未来很可能最终会发现通用越狱方法。我们在发布 Fable 5 时已明确说明了这一点。
  • 鉴于目前看来完美的越狱抵抗能力并不可能实现,Anthropic 对 Fable 5 采取了纵深防御策略。我们的目标是使越狱要么范围狭窄(在非通用越狱的情况下),要么成本极高(在通用越狱的情况下),并将其与全面监控相结合,以便快速检测并关闭任何成功的攻击。这也是 Anthropic 要求对 Fable 的客户数据进行 30 天保留的原因——这一政策变化给我们与客户的关系带来了实际成本,但使我们能够研究和缓解越狱问题。
  • 我们坚持这一纵深防御策略。它降低了 Fable 带来的风险,使其与业界已部署的现有模型的风险相当。
  • 我们甚至没有收到过关于导致有害结果的、令人担忧的非通用潜在越狱的披露。已向我们披露的潜在越狱要么是完全无害的响应,要么是未提供 Mythos 特定提升的轻微发现。

迄今为止,政府只向我们提供了可能存在一种狭窄、非通用越狱的口头证据,其内容基本上是要求模型读取特定代码库并修复任何软件缺陷。我们的理解是,有一种潜在的越狱被分享给了政府。我们审查了一份我们认为构成政府指令依据的报告,并验证了其中展示的能力水平在其他模型(包括 OpenAI 的 GPT-5.5)上广泛可用,并且每天都被维护系统安全的防御者所使用。我们将在接下来的 24 小时内分享更多细节。

我们正在遵守政府的法律指令,对所有用户移除对 Fable 5 和 Mythos 5 的访问权限。然而,我们不同意一个狭窄潜在越狱的发现应成为召回一个已部署给数亿人的商业模型的理由。如果这一标准适用于整个行业,我们认为这基本上会停止所有前沿模型提供商的所有新模型部署。

正如我们公开声明的那样,我们认为政府应该有能力阻止不安全的部署,作为透明、公平、清晰且以技术事实为依据的法定程序的一部分。这一行动不符合这些原则。

对于给客户带来的这一干扰,我们深表歉意。我们认为这是一场误会,并正在努力尽快恢复访问。

相关内容

Anthropic 投资 1 亿美元培训 10,000 名工程师,以解决企业 AI 人才缺口

Anthropic 正在向 Claude Frontier Academy 投资 1 亿美元,计划到 2027 年底培训 10,000 名前沿部署工程师,来自埃森哲、贝恩、CBA、德勤、麦肯锡、摩根士丹利和诺和诺德的学员批次已经启动。

阅读更多

巴克莱扩大 Claude 规模以升级运营并改善客户体验

英国全能银行巴克莱正在扩大与 Anthropic 的战略合作,将安全的企业级 AI 系统整合到其全球运营中。

阅读更多

Claude 发现了一种具有类 CRISPR 重复序列的新型酶系统

我们宣布在 Anthropic 成立一个新的生命科学研究小组和实验室。本文介绍了这项工作背后的团队,并分享了早期成果,其中 Claude 仅在我们的科学家提供高层指导的情况下,发现了一种特性令人联想到 CRISPR 的新型酶系统。

阅读更多

来源:Anthropic News · anthropic.com