Claude Fable 5 和 Claude Mythos 5 正式发布 – 搭载安全防护机制的先进 Mythos 类模型,支持分级访问

TL;DR

Anthropic 宣布 Claude Fable 5 正式上线,这是一款性能超越此前所有 Anthropic 模型的 Mythos 类模型,同时推出限量版 Mythos 5,为经过审核的网络安全专家提供更少安全限制的同等能力,后续还将面向生物研究者开放。两款模型定价均为每百万输入 token 10 美元,每百万输出 token 50 美元。


什么是 Claude Fable 5?

Claude Fable 5 是一款 Anthropic 认为已足够安全、可无限制公开使用的 Mythos 类 1 模型。它在几乎所有测试的 AI 能力基准上均达到业界领先水平,尤其在长周期、复杂任务(如大规模代码迁移、多步骤科学推理和仅视觉交互)上表现尤为突出。

核心能力

  • 软件工程 – 在 Stripe 的测试中,Fable 5 仅用一天时间就完成了 5000 万行 Ruby 代码库的迁移,而通常这类任务需要两个月的人工工作量。在 Cognition 的 FrontierCode 基准测试中,它在使用更少 token 的情况下,取得了前沿模型中的最高分。
  • 知识工作 – 在 Hebbia 的金融基准测试中,Fable 5 在高级别推理任务中取得最高分,擅长基于文档的分析、图表解读和期望值计算。IMC 报告称,该模型在事实查询、根本原因分析和估值任务中“轻松通过”了其交易分析套件。
  • 视觉能力 – Fable 5 能从科学图表中提取精确的数值数据,从截图中重建网页应用源码,并仅通过原始游戏画面玩《宝可梦 火红》,其表现超越了此前需要复杂辅助工具的 Claude 模型。
  • 长上下文记忆 – 该模型可在数百万 token 的上下文中保持连贯性,并可通过持续记录笔记提升输出质量。在卡牌构建游戏《Slay the Spire》中,基于文件的记忆扩展使其成功率比 Claude Opus 4.8 提高了三倍。
  • 生命科学研究 – 借助 Mythos 类核心,Fable 5(通过 Mythos 5)将蛋白质设计流程加速了约 10 倍,生成的分子生物学假设在 80% 的情况下优于 Opus 类模型输出,并构建出一个比近期《Science》论文中的模型小 100 倍但性能更优的基因组模型。

什么是 Claude Mythos 5?

Claude Mythos 5 与 Fable 5 使用完全相同的底层模型,但放宽了多项安全分类器。目前通过与美国政府合作的 Project Glasswing 部署,仅向一小批网络安全专家和关键基础设施提供商开放。未来将扩展至面向生物研究者的可信访问计划。

独特特性

  • 网络安全聚焦 – Mythos 5 拥有目前已知公开模型中最强的攻防网络安全能力,可实现快速漏洞发现、漏洞利用生成和多阶段攻击规划。
  • 减少安全限制 – 该模型在网络安全、生物学、化学和模型蒸馏类查询中不再默认回退至 Claude Opus 4.8,允许在可信环境中充分发挥其全部能力。
  • 定价一致 – Mythos 5 与 Fable 5 定价相同(每百万输入 token 10 美元,每百万输出 token 50 美元),相比早期的 Claude Mythos Preview,成本降低超过 50%。

安全架构与防护机制

Anthropic 为 Fable 5 引入了保守的安全堆栈,在保障广泛可用性的同时,最大限度降低滥用风险。

基于分类器的请求路由

  • 范围 – 三个分类器领域:网络安全、生物/化学、模型蒸馏。
  • 机制 – 当分类器标记某请求时,系统会自动将其路由至 Claude Opus 4.8(一个高性能备用模型),而非直接拒绝。
  • 影响 – 平均每会话中回退情况不足 5%;超过 95% 的会话无需任何重定向即可正常进行。

抗越狱能力

  • 内部红队测试及外部漏洞赏金计划(累计超 1000 小时)未发现任何通用越狱方法。
  • 一位外部合作伙伴报告,在 30 种不同的公开越狱技术中,均未成功发起恶意网络安全查询。
  • 对比图表(见源图)显示,Fable 5 的防护机制在抵御越狱攻击方面,优于此前公开的模型(如 Opus 4.8)。

数据保留政策

  • 所有 Mythos 类模型的流量仅保留 30 天,用于安全相关分析;不会用于训练新的 Claude 模型
  • Anthropic 会记录所有对保留数据的人工访问行为,并在保留期结束后立即删除,提供额外的隐私保护。

早期客户反馈

多位早期接入合作伙伴报告了显著的生产力提升:

  • CursorBench – Fable 5 创下新纪录,解锁了长周期问题求解能力。
  • GitHub – 开发者观察到模型能自主、可靠地处理复杂、多步骤的编码任务,推动向“交接式”智能体工作流转变。
  • 法律审查 – 律师指出,Fable 5 的合同修订能力达到或超过现有模型水平。
  • 金融与分析 – 该模型在 Anthropic 核心分析基准测试中突破 90% 阈值,比 Opus 4.8 提升 10 个百分点。
  • 科学研究 – Fable 5 在 36 小时内实现了物理研究基准的近乎全覆盖,速度提升相当于 GPT‑5.5 四天的工作量。

(完整引述内容以源图中的图注形式呈现;上述要点为报告情绪的综合摘要。)

定价与可用性

  • 定价 – 每百万输入 token 10 美元,每百万输出 token 50 美元(低于 Claude Mythos Preview 的一半成本)。
  • 通用访问 – Claude Fable 5 已对所有 API 用户立即开放。
  • 订阅计划分级上线 – 从发布至 6 月 22 日,Pro、Max、Team 及基于席位的企业计划用户可免费使用 Fable 5;此后需使用使用额度,直至容量允许更广泛覆盖。
  • Mythos 5 – 目前仅限 Glasswing 合作伙伴;面向生物研究者的可信访问计划将后续开放。

对 AI 生态系统的影响

  • 性能新边界 – Fable 5 为自主、长上下文推理设立了新标杆,显著缩小了 AI 与人类高级专家在软件、金融和科学领域的差距。
  • 安全优先部署 – 通过将高风险请求路由至稍弱的模型,Anthropic 展示了一种在释放强大模型的同时有效控制滥用风险的务实路径。
  • 经济影响 – 低于半价的定价可能加速前沿模型在企业工作流中的采用,可能重塑 AI 增强型开发与研究的成本结构。
  • 政策意义 – 分级可信访问机制与 30 天数据保留规则,为平衡开放性与国家安全关切提供了可复制的范例,其他前沿实验室或可效仿。

上述所有图表、基准表格和示例图像均源自 Anthropic 的官方公告与系统卡片。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch