Claude Fable 5 和 Mythos 5:能力、限制和开放方式
Anthropic 发布 Claude Fable 5 和 Claude Mythos 5:前者面向所有用户,后者面向受信任访问计划,重点是更强的长任务、代码、视觉和科研能力,以及更严格的安全措施。

来源链接: https://www.anthropic.com/news/claude-fable-5-mythos-5
Anthropic 发布了 Claude Fable 5:一个 Mythos 级别的模型,并经过安全处理,面向通用使用场景开放。
Fable 5 的能力超过了 Anthropic 以往面向大众开放的任何模型。在几乎所有经过测试的 AI 能力基准上,它都处于领先水平,在软件工程、知识工作、视觉、科学研究等领域表现突出。任务越长、越复杂,Fable 5 相比 Anthropic 其他模型的优势越明显。
但发布这样能力级别的模型也带来风险。若缺少防护,Fable 5 在网络安全等领域的能力可能被滥用,造成严重破坏。因此,Anthropic 为该模型配置了安全机制:部分主题的请求会改由下一个最强模型 Claude Opus 4.8 响应。为了在安全和速度之间取得平衡,这些防护机制目前调得较为保守,有时会拦截无害请求;平均来看,触发比例低于 5% 的会话。随着更强模型在未来几个月到来,Anthropic 表示会尽快改进防护并降低误报。
面向一小部分网络防御者和基础设施提供方,Anthropic 同时推出 Claude Mythos 5 。它与 Fable 5 使用同一个基础模型,但在部分领域移除了防护限制。 Mythos 5 初期将通过 Project Glasswing 与美国政府合作部署,作为 Claude Mythos Preview 的升级版本。 Anthropic 称,它具备当前全球最强的网络安全能力。随后,Anthropic 计划通过更广泛的受信任访问计划扩大 Mythos 5 的使用范围。
Fable 5 和 Mythos 5 这类模型有潜力产生重要的积极影响。在 Project Glasswing 中,这些模型已经帮助网络防御人员保护关键软件;在生命科学研究中,它们也在提出新的假说,并加速新疗法开发。
两款模型的价格为:输入每百万 tokens 10 美元,输出每百万 tokens 50 美元,低于 Claude Mythos Preview 价格的一半。 Anthropic 将这次联合发布视为继续把先进 AI 能力更快、更安全地带给更多用户的一步。
评估 Claude Fable 5 和 Claude Mythos 5
下图展示了 Fable 5 、 Mythos 5 与其他领先模型的能力对比。

Fable 5 和 Mythos 5 能够比此前任何 Claude 模型更长时间地自主工作。 Anthropic 重点展示了这些能力如何应用于软件工程,并介绍其在知识工作、视觉、记忆、长上下文和生命科学研究方面的提升。
软件工程
在早期测试中,Stripe 表示,Fable 5 将数月工程工作压缩到了数天。在一个 5000 万行 Ruby 代码库中,该模型用一天完成了一次跨代码库迁移;若由人工完成,原本需要一个完整团队手动工作两个多月。
Fable 5 也比过去的 Claude 模型更节省 tokens 。在 Cognition 的 FrontierCode 评测中,模型需要完成高难度编码任务,并符合高质量生产代码库的标准。 Fable 5 即使在中等推理强度下,也在前沿模型中取得最高分。


知识工作
Fable 5 在复杂分析任务上表现很强。在 Hebbia 面向高级推理的 Finance Benchmark 中,Fable 5 得分高于其他模型,在基于文档的推理、图表和表格理解、问题解决方面都有显著提升。
IMC 也指出,Fable 5 在其交易分析评测中几乎全面通过,包括事实查找、概念推理、根因分析和期望值分析。
视觉
Fable 5 成为新的视觉任务领先模型。它可以从细致的科学图表中提取精确数字,也可以完成复杂的视觉任务,例如仅根据截图重建 Web 应用的源代码。
它对额外脚手架的依赖也更少。例如,过去的 Claude 模型即使配备辅助工具,也难以玩好《宝可梦 火红》;Fable 5 则凭借一个极简、仅依赖视觉的环境通关了 FireRed 。
记忆与长上下文
Fable 5 能够在数百万 tokens 的长时任务中保持专注,并利用自己的笔记改进输出。 Anthropic 让模型玩卡牌构筑游戏 Slay the Spire 时发现,给 Fable 5 提供基于文件的持久记忆后,其表现提升幅度是 Opus 4.8 的三倍;Fable 到达游戏最终章节的频率也高出三倍。
药物设计
借助 Mythos 5,Anthropic 内部蛋白质设计专家将药物设计流程中的部分环节提速约十倍。一个案例中,Mythos 5 配合蛋白质设计和生物信息学工具,在没有人类协助的情况下,达到或超过熟练的人类操作员。
模型完成了科学家通常需要完成的全部任务:选择结合位点、选择并运行蛋白质设计工具,并在过程中从失败中恢复。在该研究的 14 个蛋白质靶点中,有 9 个产生了强候选分子,Anthropic 正在进一步研究。

Mythos 5 设计的蛋白质复合物。靶点包括免疫检查点、生长因子与受体信号通路、神经退行性疾病、肌肉疾病,以及更难的结构靶点。
分子生物学中的新假说
Mythos 5 是 Anthropic 首个能够稳定产出新颖且有说服力科学假说的模型。在与 Opus 级模型的盲测对比中,Anthropic 科学家约 80% 的时间更偏好 Mythos 提出的分子生物学假说,并已将其中几个推进到实验评估。
同时,Mythos 提出的一个假说——关于大肠杆菌某种蛋白的新机制——已在一个独立研究同一问题的实验室研究中得到支持。
基因组学中的新研究
Mythos 5 在超过一周、很大程度上自主运行的过程中开展了新的基因组学研究。它整理了涵盖 138 个动物物种、数百万细胞的单细胞数据,并设计和训练了一个定制机器学习模型,用于识别即使在亲缘关系很远的生物中也承担相同功能的细胞。
在只有高层级人类输入的情况下,Mythos 5 训练出的模型超过了近期发表在 Science 上的一个模型,且参数规模小 100 倍。 Anthropic 计划在未来几个月发布这些结果。
对齐评估
在自动化对齐评估中,Anthropic 发现 Mythos 5 的不对齐行为水平较低,并与 Opus 4.8 相近。这类行为包括欺骗等模型采取的不对齐行动,以及配合用户滥用模型。由于 Fable 5 与 Mythos 5 使用同一个基础模型,Anthropic 预计 Fable 5 的对齐水平相近。
相关评估连同一套详细安全和能力测试,收录在模型 system card 中。

自动化对齐评估中的整体不对齐行为水平。更多信息见 system card 第 6.2.3.1 节。
Claude Fable 5 的早期反馈
获得早期访问权限的客户进行了自己的测试。以下为部分反馈要点。

CursorBench 上,Claude Fable 5 处于领先水平。它打开了一类此前模型无法处理的长周期问题。——Michael Truell,CEO 与联合创始人

对 GitHub 服务的开发者来说,Claude Fable 5 是一次明显进步。早期测试中,它能处理复杂、长周期编码任务,在自主性和可靠性上超过过去基准;这也指向一个未来:开发者可以把更有挑战性的工作交给 agent,并在软件生命周期中信任结果。——Mario Rodriguez,首席产品官

这是他们有机会测试过的 Claude 模型中最强的一组结果。 Claude Fable 5 在 agentic coding 和原型开发上向前迈出清晰一步。——Matt Colyer,开发者产品总监

Claude Fable 5 的推理明显超过 Opus 4.8,能以高级研究科学家的方式工作:选择方向、分配资源、修正错误判断,并产出新的第一性原理结果。——Sean Ward,CEO 与联合创始人

Claude Fable 5 理解构建者的意图,而不只是输入的文字。一年前需要上百次提示的应用,现在它可以一次生成。客户遇到难点时,这是他们会选择用来快速越过障碍的模型。——Fabian Hedin,CTO 与联合创始人

Claude Fable 5 带来实质差异。在盲审中,律师发现它给出的修订意见每次都能匹配或超过当前模型。——Aveek Duttagupta,技术成员

在最高推理强度下,Claude Fable 5 会反思并验证自己的工作。对他们而言,这使高度自主的操作成为可能,额外思考带来的收益足以覆盖成本。——Yusuke Kaji,AI for Business 总经理

Claude Fable 5 能用更少轮次交付更强工程能力,处理员工每天在 Claude Code 中运行的复杂多 agent 工作流。——Luke Anderson,CTO

Claude Fable 5 是 Cognition 前沿编码评测 FrontierBench 上得分最高的模型。它擅长长周期推理,并能直接泛化到陌生工具。——Scott Wu,CEO

Claude Fable 5 是他们测试过的最强金融优先模型,在通用金融和推理上都表现突出。——Damian Miraglia,应用 AI 首席工程师

Claude Fable 5 首个在其核心分析基准中突破 90%,该基准面向复杂、长时间运行的分析任务;相比 Opus 提升 10 个百分点。在最难的问题上,它展现出很强的判断力和对细微差别的关注。——Izzy Miller,AI 研究负责人

Claude Fable 5 是他们在前沿物理研究上测试过的最强模型,同时只使用三分之一推理 tokens 。它在 36 小时内接近 GPT-5.5 四天后的水平。——Matthew Pines,CEO

在端到端 vibe-coding 基准 ViBench 上,Claude Fable 5 是他们测试过的最高性能模型,几乎覆盖基础用例,并用更少时间和 tokens 构建应用。——Michele Catasta,总裁兼 AI 负责人

Claude Fable 5 在他们的日常电子表格套件中,在每个推理强度下都超过 Opus 4.8;它使用更少轮次,完成速度快 25–30% 。——Peter Wang,首席科学官
Claude Fable 5 的新安全措施
Mythos 级模型已经达到会带来显著风险的门槛。 4 月,Anthropic 启动 Project Glasswing,将首个 Mythos 级模型 Claude Mythos Preview 仅提供给有限数量的网络防御者和关键软件基础设施提供方。当时 Anthropic 表示,希望最终把 Mythos 级能力提供给所有用户,前提是开发出足够强、可可靠防止滥用的新防护措施。
过去几个月,Anthropic 持续改进这些防护措施。现在,它们已足够稳健,支持通用发布。由于优先考虑安全,Anthropic 有意把防护调得谨慎,目前仍比理想状态更严格;例如,一些良性请求会触发分类器。 Anthropic 承认这会让部分用户感到受挫,并表示会在发布后继续更新和调整防护,以降低误报。
下面依次介绍 Fable 5 的新防护。更完整的防护体系及评估,见模型 system card 和最新风险报告。
安全分类器
Mythos 级模型在前沿网络安全和研究生物学方面的能力,意味着它们可能显著提升恶意行为者的能力。换言之,这类模型可能提供信息或建议,帮助恶意行为者造成其无法通过其他来源(例如搜索引擎)获得的严重伤害。
同时,很多高级 AI 用法具有双重用途。同样的问题,在网络安全专业人员和生物学研究者手中可能有益;若落到恶意行为者手中,则可能危险。
因此,Anthropic 需要强防护来阻止滥用,覆盖范围也需要足够广。防护本身必须能经受持续、复杂的绕过尝试,也就是通常所说的 jailbreak 。 Mythos 级能力的提升对许多对手有价值,例如可从网络攻击中获利的人,因此 Anthropic 预期他们会有动机绕过安全措施。
Fable 5 配备了一组新的分类器:这些独立 AI 系统用于检测潜在滥用,包括 jailbreak 尝试,并阻止主模型(这里是 Fable 5)响应。 Anthropic 已经在模型上运行分类器一段时间,Fable 5 的分类器是在此前工作的基础上扩展了覆盖范围。
当 Fable 的分类器检测到请求涉及网络安全、生物与化学、或蒸馏时,响应会自动改由 Claude Opus 4.8 处理。用户会在发生这种情况时得到提示。 Opus 4.8 本身也是能力很强的模型;相比 Fable 直接拒答,回退到 Opus 能带来更好的体验。早期数据显示,超过 95% 的 Fable 会话没有发生回退;在这些会话中,Fable 5 的表现实际上与 Mythos 5 相同。
分类器覆盖以下几个领域。
1. 网络安全
Mythos 级模型擅长发现和利用软件漏洞,因此可能让网络攻击变得更容易、更便宜。它们也展现出很强的 agentic hacking 能力:除寻找漏洞外,还能执行网络攻击中的多个环节,包括侦察、发现、横向移动等。
为了防止这些 agentic hacking 能力提升网络攻击,Anthropic 设计的网络安全分类器同时覆盖漏洞利用和更广泛的进攻性网络任务。如下图所示,分类器可以阻止 Fable 在这些任务上取得进展。

网络评测结果:Fable 5 以阻断响应而非回退到 Opus 4.8 的模式运行。评测未包含规避防护的尝试。
Anthropic 对分类器进行了大量红队测试,以检验其抵御 jailbreak 的能力。除内部测试外,Anthropic 还运行了外部漏洞赏金计划,在超过 1000 小时测试中没有发现通用 jailbreak 。参与的外部红队组织到目前为止也未在长形式 agentic 任务中找到通用 jailbreak;不过英国 AISI 在较短初始测试窗口内取得了一些进展。
Anthropic 表示,完全阻止通用 jailbreak 可能并不可行;目标是让剩余 jailbreak 足够缓慢且成本高昂,从而在其规模化使用前被检测并阻止。
下图来自 Anthropic 内部评估,展示了 Fable 5 的防护如何使其相比此前普遍可用模型具备更强的 jailbreak 抵抗能力。

内部评估结果:自动化红队在 400 轮内尝试使用模型完成一个与进攻性网络安全相关的短任务,被阻断时会重启和回退。任务大多较简单,不能代表真实网络使用场景;有些任务简单到只是加密远程服务器上的文件。对于更复杂、更真实的任务,Anthropic 尚未在生产系统中看到成功 jailbreak 。注:Opus 4.6 没有阻断型网络安全防护。
一位外部合作伙伴发现,在其测试过的模型中,Fable 5 针对有害网络请求的防护最稳健,包括 Opus 4.8 和 Opus 4.7 。无论请求是否使用 30 种公开 jailbreak 技术之一,Fable 5 对规划网络攻击、漏洞开发或规避防御相关的有害单轮请求都没有给出配合。
2. 生物与化学
Anthropic 长期使用分类器阻止模型回答一小部分与生物武器相关的问题。但 Anthropic 现在不再确定,仅阻断这部分狭窄问题是否足够。
原因有两点:其一,有理由担心资源充足的恶意行为者试图利用模型推进高风险生物研究;其二,模型完成现实科学任务的能力已经增强。
例如,Anthropic 测试了 Mythos 5 完成腺相关病毒(AAV)设计中一个挑战步骤的能力。 AAV 是递送基因疗法的组成部分,但同样能力若被错误使用,也可能帮助设计危险病毒。在该任务中,不同 AI 模型被评估其预测基因修改如何影响病毒外壳组装的能力;这些候选来自 Dyno Therapeutics 开发的、具有治疗相关性的未发表候选集合。
Anthropic 没有专门训练模型完成该任务,但 Mythos 级模型仅凭生物学推理,就超过了专用于蛋白质任务的复杂模型(即“蛋白语言模型”)。这说明模型有望完成基因疗法研发中简单但重要的任务,也凸显了双重用途能力带来的风险。

评估结果:模型预测一种简单病毒外壳的未发表实验性质。在这一情境下,病毒外壳组装是最简单的病毒特征预测任务,但在设计更复杂特征时,它仍是必须准确把握的重要属性。 AAV = 腺相关病毒。
Anthropic 的优先事项是尽快安全发布 Fable,即使代价是防护范围偏宽。因此,现阶段 Fable 在大多数生物和化学相关请求上会回退到 Opus 4.8 。 Anthropic 希望尽快缩小这些防护范围;前面的证据也显示,Fable 在科学应用上有很大潜力,不希望分类器误报阻碍这些应用。
未来几周,一些生物医学研究者和公司将可以加入 Mythos 5 生物能力的受信任访问计划。
3. 蒸馏
Anthropic 此前识别出大规模提取(“蒸馏”)Claude 能力、用于在威权国家训练竞争模型的尝试。蒸馏 Fable 5 的能力可能间接导致接近前沿的 AI 能力扩散,而这些能力可能在没有适当防护的情况下被发布。分类器判定为此类蒸馏尝试的请求,会回退到 Opus 4.8 。
新的数据保留政策
Anthropic 还将调整 Fable 5 、 Mythos 5 以及未来类似或更高能力级别模型的企业客户数据处理方式。对于所有 Mythos 级模型的流量,无论来自第一方还是第三方界面,都将要求 30 天保留。
Anthropic 表示,不会使用这些数据训练新的 Claude 模型,也不会用于任何非安全相关目的;同时已经引入新的隐私保护,包括记录所有人工访问数据的行为,并确保几乎所有情况下数据会在 30 天后删除。相关数据将帮助 Anthropic 防御复杂且新型的攻击,包括新的 jailbreak 以及跨多个请求运行的攻击,也会帮助识别并减少误报。
Claude Mythos 5 与受信任访问计划
从发布日起,所有当前拥有 Claude Mythos Preview 访问权限的用户,例如 Project Glasswing 中的网络安全合作伙伴,都可以升级到 Claude Mythos 5 。它与 Claude Fable 5 是同一个模型,但移除了网络安全防护。用户在多数情况下会发现 Mythos 5 与 Mythos Preview 相当或略强,同时成本显著降低。
Anthropic 表示,在与美国政府协商后,计划稳步扩大 Claude Mythos 5 的访问范围,继续定期增加新合作伙伴,并推进一个允许网络安全组织以更系统方式申请的受信任访问计划。
计划还包括开放面向生物领域的受信任访问计划,以利用 Mythos 级能力加速生物医学研究和新疗法发现。该计划将提供移除生物与化学防护的 Fable 5 访问权限,但网络安全防护仍会保留。它将纳入少量来自不同生命科学组织的研究者,覆盖基础研究和转化研究;Anthropic 计划在继续改进防护的同时扩大该计划访问范围。
可用性与价格
Claude Fable 5 从今天起面向所有地区可用。 Claude Mythos 5 在更广泛的受信任访问计划开放前,仅限 Glasswing 合作伙伴(移除网络安全防护)以及即将加入的部分生物研究者(移除生物与化学防护)使用。
两款模型价格相同:输入每百万 tokens 10 美元,输出每百万 tokens 50 美元。开发者可以通过 Claude API 使用 claude-fable-5。
Anthropic 预计 Fable 5 的需求会非常高,需求曲线也难以预测。在 Claude API 和按用量计费的 Enterprise 计划中,Fable 5 从今天起完全可用。对订阅计划,Anthropic 希望尽早提供访问,因此会更保守、分阶段推出:
- 从今天到 6 月 22 日,Fable 5 将包含在 Pro 、 Max 、 Team 和按席位计费的 Enterprise 计划中,不额外收费。
- 6 月 23 日,Anthropic 会将 Fable 5 从这些计划中移除。之后使用 Fable 5 将需要 usage credits 。若容量允许,Anthropic 会延长包含使用窗口。
- 在此之后,当容量足够时,Anthropic 目标是把 Fable 5 恢复为订阅计划的标准组成部分,并会尽快推进。
在此期间,Anthropic 会提前沟通任何变化,让用户了解当前状态。
备注
- 2026 年 6 月 9 日更新:关于 AAV 的讨论已更新,以说明候选由 Dyno Therapeutics 开发。
- Mythos 级模型是 Claude 模型中能力高于 Opus 级的一层。首个 Claude Mythos Preview 已于 4 月通过 Project Glasswing 发布;此次接续发布 Claude Fable 5 和 Claude Mythos 5 。
- Fable 来自拉丁语
fabula,意为“被讲述之物”,与希腊语mythos相近。防护措施区分了 Fable 与 Mythos,也解释了两个名称的由来。 - 网络评测指标:Firefox = 达成任意代码执行的试验比例(漏洞利用的完全成功层级);OSS-Fuzz = 五档评分的严重性加权平均(0.2 崩溃 → 1.0 控制流劫持),因此数值是加权平均而非成功率;CyberGym = 复现目标漏洞的比例(公开排行榜指标);CyScenarioBench = 各挑战成功率等权平均。
- 通用 jailbreak 可定义为任何提示、脚本或环境,使用户能够像模型没有防护一样与其交互。它区别于更轻微的 jailbreak,后者只在非常有限的情境中有效,或需要额外工作才能适配新情境。