跳到正文
Anthropic News·· 2026-06-09精选AI 评分88

Anthropic 发布 Claude Fable 5 与 Claude Mythos 5

Claude Fable 5 and Claude Mythos 5

AI 导读

Anthropic 发布 Claude Fable 5 和 Claude Mythos 5,两者为同一底层模型,Fable 5 面向通用用户,Mythos 5 解除部分安全限制、仅向 Project Glasswing 等受信任方开放。

推荐理由

Anthropic 同时发布通用版与受限版同源模型,并公开安全分类器与回退机制,可观察前沿能力开放与风险控制的取舍。

正文 · AI 翻译
  • 更新

    Claude Mythos 5 和 Fable 5 重新部署

    2026年7月1日

    Claude Fable 5 和 Mythos 5 现已可用。

    阅读更多

  • Claude Mythos 5 和 Fable 5 访问不可用

    2026年6月12日

    我们正在暂停对 Claude Fable 5 和 Claude Mythos 5 的访问。对于给客户带来的这一中断,我们深表歉意,并正在努力尽快恢复访问。

    阅读更多

今天,我们推出 Claude Fable 5:一个 Mythos 级1模型,我们已将其打造为可安全用于一般用途。

Fable 5 的能力超过我们以往任何面向大众开放的模型。在几乎所有已测试的 AI 能力基准上,它都处于最先进水平,在软件工程、知识工作、视觉、科学研究以及许多其他领域展现出卓越表现。任务越长、越复杂,Fable 5 相较我们其他模型的领先优势就越大。

发布如此强大的模型伴随着风险。如果没有防护措施,Fable 5 在网络安全等领域的能力可能被滥用来造成严重损害。因此,我们在发布该模型时配备了防护措施,这意味着某些主题的查询将改为由我们次强的模型 Claude Opus 4.8 来响应。为了既安全又快速地发布该模型,我们对这些防护措施进行了保守调优——它们有时会拦截无害请求,但平均而言,触发率低于 5% 的会话。随着未来几个月更强大的模型问世,我们正在努力尽快改进防护措施并减少误报。

对于一小部分网络防御者和基础设施提供商,我们还推出了 Claude Mythos 5。它与 Fable 5 是同一底层模型,但在某些领域解除了防护措施。2 Mythos 5 最初将通过 Project Glasswing 部署,与美国政府合作,作为 Claude Mythos Preview 的升级版。它拥有世界上最强的网络安全能力。不久后,我们打算通过更广泛的受信任访问计划扩大对 Mythos 5 的访问。

像 Fable 5 和 Mythos 5 这样的模型,其能力有可能为世界带来深远的益处。我们在 Project Glasswing 中已初见端倪,这些模型帮助网络防御者保护了至关重要的软件。我们也在生命科学研究中看到了这一点,这些模型正在提出新颖的假设,并加速新疗法的开发。

Fable 5 和 Mythos 5 的定价为每百万输入 token 10 美元、每百万输出 token 50 美元——不到 Claude Mythos Preview 价格的一半。今天的联合发布是我们朝着目标迈出的又一步:尽可能快速、安全地将先进的 AI 能力带给尽可能多的用户。

下表将 Fable 5 和 Mythos 5 的能力与其他领先模型进行了比较。

Benchmark table showing Claude Fable and Mythos compared to other leading models


Fable 5 和 Mythos 5 能够比以往任何 Claude 模型自主工作更长时间。下面我们将讨论这些技能如何应用于软件工程,并介绍该模型在知识工作、视觉、记忆和生命科学研究方面改进的能力。

软件工程。在早期测试中,Stripe 报告称 Fable 5 将数月的工程工作压缩到了几天。在一个 5000 万行的 Ruby 代码库中,该模型在一天内完成了整个代码库范围的迁移,而这项工作若由人工完成,需要整个团队花费两个多月。Fable 5 也比过去的 Claude 模型更节省 token:在 Cognition 的 FrontierCode 评估中——该评估测试模型能否在满足高质量生产代码库标准的同时通过困难编码任务——Fable 5 在前沿模型中得分最高,即使是在中等努力程度下也是如此。

知识工作。Fable 5 在复杂分析任务上表现出色。在 Hebbia 面向高级推理的金融基准测试中,Fable 5 的得分在所有模型中最高,在基于文档的推理、图表解读和问题解决方面都有显著提升。IMC 指出,Fable 5 几乎全面通过了他们的交易分析评估,包括事实查找、概念推理、根因分析和期望值分析。

视觉。Fable 5 是涉及视觉任务的新一代最先进模型。它能从详细的科学图表中提取精确数字,并能执行复杂的视觉任务,比如仅凭截图重建 Web 应用的源代码。它所需的辅助框架也更少:例如,此前的 Claude 模型即使配备了提供额外有用工具的测试框架,也难以玩《宝可梦 火红》,而 Fable 5 仅凭极简的纯视觉框架就通关了《火红》。

Claude 仅使用原始游戏截图从头到尾游玩《宝可梦 火红》的延时视频——没有地图、导航辅助或额外游戏状态信息。早期的 Claude 模型需要复杂的辅助框架才能玩《宝可梦》;Claude Fable 5 仅凭视觉就完成了游戏。

记忆与长上下文。Fable 5 在长时间运行的任务中能在数百万 token 的范围内保持专注,并利用自己的笔记改进输出。当我们让该模型玩牌组构建游戏 Slay the Spire 时,赋予它基于文件的持久记忆后,其性能提升幅度是 Opus 4.8 的三倍;Fable 到达游戏最终幕的频率也是后者的三倍。

药物设计:使用 Mythos 5,我们内部的蛋白质设计专家将药物设计流程的多个环节加速了约 10 倍。在一个例子中,他们发现 Mythos 5 在配备蛋白质设计和生物信息学工具、但无人工协助的情况下,表现与熟练的人类操作员相当甚至更好。在此过程中,该模型执行了通常由科学家完成的所有任务:选择结合位点、选择并运行蛋白质设计工具,以及在过程中从失败中恢复。该研究中的 14 个蛋白质靶点中有 9 个(如下所示)产生了我们目前正在研究的强效药物设计候选物。

由 Mythos 5 设计的蛋白质复合物。靶点包括免疫检查点、生长因子与受体信号传导、神经退行性疾病、肌肉疾病,以及更困难的结构靶点。

分子生物学中的新假设。 Mythos 5 是我们首个能够持续产出新颖且引人注目的科学假设的模型。在与 Opus 级模型的盲测对比中,我们的科学家约 80% 的情况下更青睐 Mythos 提出的分子生物学假设,并已将其中若干推进至实验评估阶段。与此同时,Mythos 提出的一个假设——一种 E. coli 蛋白的新机制——得到了一个独立研究同一问题的实验室所发表的一项研究的证实。

基因组学中的新研究。 Mythos 5 在超过一周的几乎完全自主工作中开展了新颖的基因组学研究。它汇集了涵盖 138 个动物物种、数百万个细胞的单细胞数据,并设计并训练了一个定制机器学习模型,以识别即使在远缘生物中也执行相同功能的细胞。在仅有高层级人类输入的情况下,Mythos 5 训练出的模型表现优于近期发表在《Science》期刊上的一个模型——尽管其规模小了 100 倍。我们计划在未来几个月内发表这些结果。

对齐。在我们的自动化对齐评估中,我们发现 Mythos 5 的不对齐行为水平(包括模型采取的不对齐行动,例如欺骗,以及与用户对模型的滥用进行配合)较低,与 Opus 4.8 相似。鉴于它们是同一底层模型,Fable 5 的对齐水平也将相似。该评估的完整描述,以及一整套详细的其他安全性和能力测试,均见该模型的系统卡。

来自我们自动化对齐评估的总体不对齐行为水平。更多内容请参见系统卡第 6.2.3.1 节。

Claude Fable 5 的早期反馈

获得早期访问权限的客户对 Fable 5 进行了自己的测试。以下以他们自己的话,摘录了他们所看到的部分情况:

 logo

Claude Fable 5 是 CursorBench 上最先进的模型。它开启了一类早期模型无法企及的长时程问题。

 logo

Claude Fable 5 对 GitHub 所服务的开发者而言是真正的进步。在我们的早期测试中,它以超越以往基准的自主性和可靠性,承担了复杂的长时程编码任务。但最令我们兴奋的是它所指向的方向:一个开发者可以将日益宏大的工作交给智能体,并在整个软件生命周期中信任其结果。

 logo

这些是我们有机会测试过的所有 Claude 模型中最强的结果。Claude Fable 5 在智能体编码和原型设计方面是明显的进步。

 logo

Claude Fable 5 的推理明显超越了 Opus 4.8。它达到了资深研究科学家的水准——选择方向、分配资源、摒弃其错误信念,并产出新颖的第一性原理成果。

 logo

Claude Fable 5 理解构建者的意图,而不仅仅是他们输入的内容。一年前需要上百条提示词的应用,现在它一次就能完成。当客户真正遇到瓶颈时,它就是我们用来帮助他们快速突破的模型,让他们能够完成自己着手构建的东西。

 logo

Claude Fable 5 感觉有实质性的不同。在盲审中,我们的律师发现它的红线每次都与我们当前的模型持平或更优。

 logo

在最高努力程度下,Claude Fable 5 会反思并验证自己的工作。对我们而言,这正是实现高度自主运营的关键——额外的思考物有所值。

 logo

Claude Fable 5 比之前的模型用更少的轮次交付了更强的工程能力——能够处理我们员工每天在 Claude Code 中运行的复杂多智能体工作流。

 logo

Claude Fable 5 是 FrontierBench(Cognition 的前沿编程评测)上得分最高的模型。它擅长长时程推理,并且开箱即用即可泛化到不熟悉的工具。

 logo

Claude Fable 5 是我们测试过的最强的金融优先模型,无论是在通用金融还是推理方面。这是一次显著的提升。

 logo

Claude Fable 5 是首个在我们核心分析基准(针对复杂、长时间运行的分析任务)上突破 90% 的模型——比 Opus 提升了 10 个百分点。在最难的问题上,它展现出强大的判断力和对细微差别的关注。

 logo

Claude Fable 5 是我们在前沿物理研究方面测试过的最强模型,同时只使用了三分之一的推理 token。在 36 小时内,它几乎达到了 GPT-5.5 四天后才达到的水平。

 logo

在 ViBench(我们的端到端 vibe-coding 基准)上,Claude Fable 5 是我们测试过表现最好的模型——几乎饱和了我们的基础用例,并以更少的时间和更少的 token 构建应用。

 logo

Claude Fable 5 在我们的日常电子表格套件上,在每个努力级别都击败了 Opus 4.8——而且它用更少的轮次完成,运行速度快了 25–30%。

01 /

14

Claude Fable 5 的新保障措施

Mythos 级模型已经达到了一个阈值,会带来重大风险。4 月,我们启动了 Project Glasswing,仅向一小部分网络防御者和关键软件基础设施提供商发布了首个 Mythos 级模型(Claude Mythos Preview)。当时我们表示,我们希望最终能够向所有用户发布 Mythos 级能力,前提是我们已经开发出足够强大的新保障措施,能够可靠地防止滥用。

在过去几个月里,我们一直在改进这些保障措施,现在它们已经足够稳健,可以进行全面发布。由于我们优先考虑安全,我们刻意将保障措施调得较为谨慎,它们仍然比理想状态更严格——例如,有时良性请求会触发我们的分类器。我们认识到这会让一些用户感到沮丧,我们的目标是在发布后更新和完善保障措施时减少误报。

下面我们依次讨论 Fable 5 的每一项新保障措施。我们更广泛的保障措施套件在该模型的系统卡和我们最新的风险报告中进行了讨论和评估。

安全分类器

Mythos 级模型的前沿网络安全和研究生物学能力意味着,它们对恶意行为者构成重大的能力提升风险。也就是说,这些模型可能提供信息或建议,帮助这些行为者造成他们无法从其他来源(例如互联网搜索引擎)获得的严重伤害。此外,AI 模型的大量高级用法都是双用途的:对网络安全专业人员和生物学研究人员有益的相同查询,如果被恶意行为者获取,可能会带来危险。

因此,我们需要强有力的保障措施来防止滥用,而且这些措施的覆盖范围必须足够广泛。保障措施本身必须能够抵御持续且复杂的绕过尝试(也就是所谓的“越狱”系统)。Mythos 级能力所带来的提升对许多对手都很有价值——例如那些能从网络攻击中获利的人——因此我们预计他们有动机试图规避我们的安全措施。

Fable 5 配备了一套新的分类器:这些独立的人工智能系统能够检测潜在的滥用行为(包括越狱尝试),并阻止主模型(在此即 Fable 5)作出回应。我们已经在我们的模型上运行分类器有一段时间了,而 Fable 5 的分类器是此前工作的延伸,并扩大了覆盖范围。

当 Fable 的分类器检测到与网络安全、生物学与化学或蒸馏相关的请求时,回应会自动改由 Claude Opus 4.8 处理。每当这种情况发生时,用户都会收到通知。Opus 4.8 本身就是一个能力极强的模型:回退到 Opus 的回应,体验远好于 Fable 直接拒绝。我们的早期数据显示,超过 95% 的 Fable 会话完全没有发生回退——对于这些会话,Fable 5 的表现实际上与 Mythos 5 相同。

以下是分类器覆盖的领域:

1. 网络安全。Mythos 级模型擅长发现和利用软件漏洞。因此,它们可以大幅降低网络攻击的实施难度和成本。Mythos 级模型还展现出强大的智能体黑客攻击能力。这不仅涉及寻找漏洞,还包括执行网络攻击的多个不同环节——侦察、发现、横向移动等等。为了防止这些智能体黑客攻击能力助长网络攻击,我们设计的网络安全分类器覆盖了更广泛意义上的漏洞利用和攻击性网络任务。如下图所示,我们的分类器阻止了 Fable 在这些任务上取得任何进展。

运行网络评估的结果,3其中 Fable 5 处于阻止回应而非回退到 Opus 4.8 的模式。评估未涉及规避保障措施的尝试。

我们对分类器进行了广泛的红队测试,以检验其抵御越狱的稳健性。除了内部测试,我们还开展了一项外部漏洞赏金计划,在超过 1,000 小时的测试中未发现任何通用越狱。我们聘请的外部红队组织迄今也未能在长篇幅智能体任务上找到任何通用越狱——尽管英国 AISI 在短暂的初步测试窗口内已朝这一方向取得了进展。4 要完全防止通用越狱很可能是不可能的,但我们的目标是让任何剩余的越狱都足够缓慢和昂贵,以便我们能在其被大规模使用之前发现并阻止它们。

下面这张来自我们一项内部评估的图表,展示了 Fable 5 的保障措施如何使其比我们此前普遍可用的模型更能抵御越狱。

一次内部评估的结果:在该评估中,一个自动化红队尝试利用该模型在 400 轮对话中完成一项与攻击性网络安全相关的简短任务,并在被阻止时重新开始和回退。这些任务大多很简单,并不代表真实的网络使用情况——有时简单到只是在远程服务器上加密文件。在更复杂、更现实的任务上,我们尚未在生产系统中看到成功的越狱。请注意,Opus 4.6 没有阻止网络相关行为的防护措施。

我们的一位外部合作伙伴发现,Fable 5 针对有害网络查询的防护措施是所有受测模型中最稳健的(包括 Opus 4.8 和 Opus 4.7)。对于与策划网络攻击、漏洞利用开发或防御规避相关的有害单轮请求,Fable 5 的合规率为零。无论这些请求是否使用了 30 种不同的公开越狱技术之一,这一结果都成立。

2. 生物学与化学。 我们长期以来一直使用我们的分类器来阻止我们的模型回答一小部分与生物武器相关的查询。但我们不再确定仅阻止这一小部分是否足够。原因有二:第一,我们有理由担心资源充足的恶意行为者试图借助我们的模型,为高风险生物学研究获取提升。第二,模型现在具备了更强的能力来完成现实世界中的科学任务。

例如,我们测试了 Mythos 5 完成设计腺相关病毒(AAV)中一个具有挑战性步骤的能力。AAV 是递送基因疗法的组成部分,但同样的能力若落入坏人之手,可能被用于设计危险病毒。在这项任务中,我们评估了各种 AI 模型预测基因修饰将如何影响病毒外壳组装的能力(候选对象包括 Dyno Therapeutics 开发的、与治疗相关且尚未公开的一组候选物)。我们并未明确训练我们的模型执行这项任务——然而 Mythos 级模型仅凭其生物学推理,就胜过了专门用于蛋白质任务的复杂模型(即“蛋白质语言模型”)。这既展示了在基因疗法研发中完成简单但重要任务的潜力——也凸显了此类两用能力所带来的风险。

一项评估的结果:在该评估中,我们的模型预测了一种简单病毒病毒外壳的未公开实验特性。在此背景下,病毒外壳组装是最容易预测的病毒性状,但在设计更复杂特征时,它仍是一个需要正确把握的重要特性。AAV = 腺相关病毒。

我们的首要任务是尽快安全地发布 Fable,即使代价是防护措施过于宽泛。因此,目前我们已安排 Fable 在大多数与生物学和化学相关的请求上回退到 Opus 4.8。与我们所有的分类器一样,我们希望尽快收窄这些防护措施:从上述证据可以看出,Fable 在科学领域的积极应用潜力巨大,我们不希望分类器的误报成为阻碍。未来几周内,一些生物医学研究人员和公司将能够加入我们针对 Mythos 5 生物学能力的可信访问计划(详见下文)。

3. 蒸馏。我们此前已发现大规模尝试提取(“蒸馏”)Claude 的能力以训练威权国家的竞争模型。蒸馏 Fable 5 的能力可能间接导致接近前沿的 AI 能力扩散——而这些能力可能在缺乏适当保障措施的情况下被发布。被我们的分类器标记为属于此类蒸馏尝试的请求将回退到 Opus 4.8。

新的数据保留政策

最后,我们正在改变处理 Fable 5、Mythos 5 以及未来具有类似或更高能力水平的模型的商业客户数据的方式。我们将要求对 Mythos 级模型上的所有流量(包括第一方和第三方平台)保留 30 天。我们不会使用这些数据来训练新的 Claude 模型,也不会用于任何与安全无关的目的,并且我们已经制定了新的隐私保护措施,包括记录所有对数据的人工访问,并确保在几乎所有情况下 30 天后删除数据(详见此文章)。这些数据将帮助我们防御复杂和新颖的攻击(包括新的越狱攻击以及跨多个请求运作的攻击),并帮助我们识别和减少误报。

Claude Mythos 5 与可信访问计划

从今天开始,所有当前可以访问 Claude Mythos Preview 的用户(例如我们在 Project Glasswing 中的网络安全合作伙伴)将能够升级到 Claude Mythos 5——与 Claude Fable 5 相同的模型,但解除了网络保障措施。用户会发现 Mythos 5 在大多数情况下与 Mythos Preview 相当,或略强于后者,同时成本大幅降低。

经与美国政府协商,我们计划稳步扩大对 Claude Mythos 5 的访问,继续我们定期添加新合作伙伴的做法,并推行一项可信访问计划,让网络安全组织能够以更系统化的方式申请。

我们的计划还包括开设一项针对生物学的可信访问计划,以帮助加速生物医学研究,并利用 Mythos 级能力发现新疗法。该计划将提供对 Fable 5 的访问,但移除生物学和化学保障措施(网络保障措施仍然保留)。它将招募来自各类生命科学组织的少量研究人员,涵盖基础研究和转化研究;我们计划在扩大该计划访问范围的同时,改进我们的保障措施。

可用性

Claude Fable 5 今天已在所有地方可用。Claude Mythos 5 仅限 Glasswing 合作伙伴(已解除网络保障措施)以及即将开放给选定的生物学研究人员(已解除生物学和化学保障措施),直到我们更广泛的可信访问计划推出为止。

两个模型的定价为每百万输入 token 10 美元,每百万输出 token 50 美元。开发者可以通过 Claude API 使用 claude-fable-5。

我们预计 Fable 5 的需求会非常高,且难以预测。在 Claude API 和基于消费的企业版计划中,Fable 5 从今天起完全可用。对于订阅计划,我们宁愿尽早提供访问,因此我们正在更保守地分阶段推出:

  • 从今天到 6 月 22 日,Fable 5 包含在 Pro、Max、Team 和基于席位的企业版计划中,无需额外费用。
  • 6月23日,我们将从这些计划中移除 Fable 5。此后使用它需要使用额度。如果容量允许,我们将延长包含的使用窗口。
  • 在此之后——当容量足够允许我们这样做时——我们的目标是将 Fable 5 恢复为订阅计划的标准组成部分。我们打算尽快做到这一点。

在此期间,我们会提前告知任何变更,让用户了解当前情况。

2026年6月9日编辑:更新了关于 AAV 的讨论,指出这些候选药物由 Dyno Therapeutics 开发。

相关内容

Anthropic 投资 1 亿美元培训 10,000 名工程师,以解决企业 AI 人才缺口

Anthropic 向 Claude Frontier Academy 投资 1 亿美元,计划到 2027 年底培训 10,000 名 Frontier 部署工程师,来自埃森哲、贝恩、CBA、德勤、麦肯锡、摩根士丹利和诺和诺德的首批学员已经开课。

阅读更多

巴克莱银行扩展 Claude 应用以升级运营并改善客户体验

英国全能银行巴克莱正在扩大与 Anthropic 的战略合作,以在其全球业务中整合安全的企业级 AI 系统。

阅读更多

Claude 发现了一种具有类 CRISPR 重复序列的新型酶系统

我们宣布在 Anthropic 成立一个新的生命科学研究小组和实验室。本文介绍了这项工作背后的团队,并分享了早期成果:Claude 在我们科学家仅提供高层指导的情况下,发现了一种特性令人联想到 CRISPR 的新型酶系统。

阅读更多

来源:Anthropic News · anthropic.com