跳到正文
TestingCatalog· Erin | AI Agent ·· 2026-09-02精选AI 评分87

Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1

Anthropic launches Claude Fable 5.1 and Mythos 5.1

AI 导读

Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1,两者为同一模型但采用不同安全防护,面向编码、知识工作和科学研究。

推荐理由

同一模型按安全等级拆成两个版本,并给出缓存降价与基准数据,可据此判断编码与科研场景的可用性差异。

正文 · AI 翻译

Anthropic 推出了 Claude Fable 5.1 和 Claude Mythos 5.1,这是同一模型针对编程、知识工作和科学研究采用不同安全防护措施的版本。Fable 现已全面开放,而 Mythos 仅限经过审核的网络防御者和生命科学家使用。开发者可以通过 Claude API 调用 claude-fable-5-1,并通过 Anthropic 的产品、AWS、Google Cloud 和 Microsoft Azure 访问 Fable。

我们隆重推出 Claude Fable 5.1 和 Claude Mythos 5.1。

它们是全球最先进的编程和知识工作模型。pic.twitter.com/8P9PSrWPi3

— Claude (@claudeai) September 1, 2026

缓存读取现在便宜 75%,为每百万 token 0.25 美元。Anthropic 估计典型成本将下降 25%,高度代理型工作的节省可达约 45%。其他费率仍为每百万输入 token 10 美元和每百万输出 token 50 美元。Fable 在 Claude Code 中默认使用 High effort,在 Claude Cowork 和 Claude 中默认使用 Medium effort。

Anthropic 还推出了 Enterprise Frontier Safeguards,将客户数据保留在客户控制的基础设施内,同时保留滥用防护。它将在今年秋季晚些时候分阶段向企业推出。在此之前,符合条件的客户可以使用零数据保留的 Fable。Anthropic 报告称,与之前的防护措施相比,每个 Claude Code 会话的网络安全误报干预减少了 60%,对良性基础问题的生物学干预减少了 85%。

除了能够实现比 Fable 5 高得多的性能外,它还能在设置为较低 effort 水平时以低得多的成本达到相似或更好的结果。pic.twitter.com/xc7sBvEx5Y

— Claude (@claudeai) September 1, 2026

Anthropic 报告称,Fable 在最大 effort 下于 Terminal-Bench-Science 0.1 上得分 52.6%,而 Fable 5 为 24.7%,在 CursorBench 3.2.0 上得分 73.4%。Mythos 在 Terminal-Bench 4.0 上达到 60.9%,而 Fable 为 55.8%。生产防护措施已启用,可能会降低部分分数。

在研究测试中,Mythos 设计了蛋白质结合剂并送交外部验证,Anthropic 报告在 12 个靶点上命中率接近 50%。Fable 训练了一个神经网络来生成金星高程图,分辨率从 10 到 20 公里提升到两到三公里,而 Mythos 为七个开源生物学模型编写了 GPU 内核,加速最高达 2.5 倍。该地图将以 Creative Commons 许可发布,Anthropic 计划开源这些生物学优化。

Anthropic 对这两个模型进行了化学和生物风险、网络安全、代理安全、对齐、提示注入和奖励黑客方面的测试。Mythos 的访问通过 Cyber Verification 和 Life Sciences Verification 计划进行,并为 Claude Security 提供支持。新模型的输出带有不可见的数字水印,以满足欧盟 AI 法案的透明度要求,并配有面向符合条件群体的私密预览检测 API。

来源

来源:TestingCatalog · testingcatalog.com