← 文章 / AI技术
The Decoder 8小时前 · 2026-09-02 06:22:04 · 1 阅读

Anthropic 发布 Claude Fable 5.1:编码与研究能力提升,成本最高降低 45%

Image description

要点

  • Anthropic 发布了两款新模型 Claude Fable 5.1 和 Mythos 5.1,编码能力更强,文本质量也更好。
  • 缓存读取降价带来了全面降本,常规任务节省约 25%,复杂的智能体工作流最多可节省 45%。
  • Fable 5.1 在智能体基准测试中超越了前代 Fable 5 以及竞品 GPT-5.6 Sol,现已上线。

更新 – 2026 年 9 月 1 日

曾协助 Anthropic 进行发布前测试的 Artificial Analysis 对这一节省成本的声明提出了异议。虽然在智能体任务上,缓存读取降价每项任务能省约 1.40 美元,但 Fable 5.1 在最高算力档位下每项任务的成本实际上比 Fable 5 高出 20%,因为它的输出 token 用量大约是后者的 1.7 倍。在最高算力档位下,Fable 5.1 每项 Intelligence Index 任务的费用为 3.76 美元,而 Opus 5 仅需 2.34 美元,得分只低 3 分。在超高档位下,Fable 5.1 每项任务得分 65、费用 2.72 美元,缩小了性价比差距,但成本仍高于 Opus 5。

Anthropic 发布了 Claude Fable 5.1 和 Mythos 5.1,这也是其迄今为止能力最强的 AI 模型。除了智能体编程和文本质量的提升之外,成本也最多降低了 45%。

和前代一样,两款 5.1 模型共享同一基础模型,区别仅在于安全护栏的严格程度。Fable 5.1 面向所有用户开放,而 Mythos 5.1 仅限于面向网络安全和生命科学的特殊访问项目。

它们也是首批内置水印的 Claude 模型。Anthropic 正在以私密预览形式上线一个检测 API,监管机构、媒体、事实核查机构和研究机构可借此验证文本中是否含有水印。公司计划逐步扩大开放范围,有意者可在此登记

Fable 5.1 在典型工作负载下比 Fable 5 便宜约 25%,在涉及大量工具调用的长时间自主运行的强代理任务中,节省幅度可达约 45%。Anthropic 通过将缓存读取价格从每百万 token 1 美元降至 0.25 美元实现了这一降价。其他 API 价格保持不变,输入和输出仍分别为每百万 token 10 美元和 50 美元。相比之下,Opus 5 的价格只有一半,即每百万 token 输入 5 美元、输出 25 美元。

价格过高是用户对 Fable 5 最大的不满,这也可能导致该模型在企业用户中采用率偏低。价格压力从 7 月底 Opus 5 发布起就在不断积累,当时它就以更低的价格在大多数基准测试中追平或超越了 Fable 5。和之前的 Claude 模型一样,新版本也配备了控制算力使用量的 effort 等级系统。在低或中等 effort 下,Fable 5.1 应能以更低成本取得与 Fable 5 相当的效果。

编码和研究基准测试大幅提升

Fable 5.1 在代理类基准测试中取得了显著进步。在 Terminal-Bench-Science 0.1 上,该模型得分达到 52.6%,是 Fable 5(24.7%)的两倍多,也远超 GPT-5.6 Sol 的 22.4%。在面向代理编码的 Terminal-Bench 4.0 上,Fable 5.1 得分为 55.8%,Mythos 5.1 达到 60.9%,而 Fable 5 为 42.0%,GPT-5.6 Sol 为 37.3%。这些提升能否在同等程度上转化为实际应用中的表现,还需在未来几周内验证。

Anthropic 研究员 Felix Rieseberg 表示,Fable 5.1 还改善了写作风格。此前模型在对话中过于依赖列表和加粗文本,Fable 5.1 减少了这类使用,同时更严格地遵循风格指令,整体表达也更自然。
Claude Fable 5.1 以 66 分登顶 Artificial Analysis 智能指数榜单,领先 Claude Opus 5(63 分)和 GPT-5.6 Sol(61 分)。| 图片来源:Artificial Analysis

Fable 5.1 向网络安全工作开放

针对网络安全、生物和医学问题的安全过滤器比之前版本更为宽松。在 5.0 模型中,这些过滤器过于敏感,连正常合理的请求也会触发,误报率高得令人头疼。 5.1 版本的网络安全过滤器误报率下降了 60%;在生物学相关查询中,对于基础的生物学和医学问题,过滤器的触发频率降低了 85%。

Fable 5.1 首次具备了识别软件漏洞的能力,但仍无法开发漏洞利用。渗透测试和漏洞利用生成仍交由 Opus 模型处理。Mythos 也已纳入 Claude Security,用于防御目的

如何访问 Fable 5.1 和 Mythos 5.1

Claude Fable 5.1 已在所有平台同步上线,包括 AWS、Google Cloud 和 Microsoft Azure。开发者可通过 API 使用 claude-fable-5-1 调用该模型。针对企业客户,Anthropic 正在推出 Enterprise Frontier Safeguards(EFS),将客户数据完全存储在客户自有的云基础设施上。

Claude Mythos 5.1 目前仅通过两项计划向美国机构开放:用于防御性安全工作的 Cyber Verification Program,以及与美国政府合作开发的 Life Sciences Verification Program。Anthropic 计划后续向国际合作伙伴开放访问权限。

Anthropic 也在加大对蒸馏攻击的打击力度——攻击者通过成千上万的虚假账号系统性地窃取模型能力。新创建的 API 账号在多轮对话中将无法再编辑 Claude 的历史上下文并保留思考过程,据 Anthropic 称此举堵住了一个已被记录的蒸馏手段。

原始来源: The Decoder

评论 (0)

Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
代理科学研究 Terminal-Bench-Science 0.1 52.6% 24.7% 29.0% 22.4%
代理编码 Terminal-Bench 4.0 55.8% / 60.9%(Mythos 5.1) 42.0% 52.3% 37.3%
知识工作 GDPval-AA v2 1853 1723 1824 1711