Anthropic 发布 Claude Fable 5.1:编码与研究能力提升,成本最高降低 45%
要点
- Anthropic 发布了两款新模型 Claude Fable 5.1 和 Mythos 5.1,编码能力更强,文本质量也更好。
- 缓存读取降价带来了全面降本,常规任务节省约 25%,复杂的智能体工作流最多可节省 45%。
- Fable 5.1 在智能体基准测试中超越了前代 Fable 5 以及竞品 GPT-5.6 Sol,现已上线。
更新 – 2026 年 9 月 1 日
曾协助 Anthropic 进行发布前测试的 Artificial Analysis 对这一节省成本的声明提出了异议。虽然在智能体任务上,缓存读取降价每项任务能省约 1.40 美元,但 Fable 5.1 在最高算力档位下每项任务的成本实际上比 Fable 5 高出 20%,因为它的输出 token 用量大约是后者的 1.7 倍。在最高算力档位下,Fable 5.1 每项 Intelligence Index 任务的费用为 3.76 美元,而 Opus 5 仅需 2.34 美元,得分只低 3 分。在超高档位下,Fable 5.1 每项任务得分 65、费用 2.72 美元,缩小了性价比差距,但成本仍高于 Opus 5。
Anthropic 发布了 Claude Fable 5.1 和 Mythos 5.1,这也是其迄今为止能力最强的 AI 模型。除了智能体编程和文本质量的提升之外,成本也最多降低了 45%。
和前代一样,两款 5.1 模型共享同一基础模型,区别仅在于安全护栏的严格程度。Fable 5.1 面向所有用户开放,而 Mythos 5.1 仅限于面向网络安全和生命科学的特殊访问项目。
它们也是首批内置水印的 Claude 模型。Anthropic 正在以私密预览形式上线一个检测 API,监管机构、媒体、事实核查机构和研究机构可借此验证文本中是否含有水印。公司计划逐步扩大开放范围,有意者可在此登记。
Fable 5.1 在典型工作负载下比 Fable 5 便宜约 25%,在涉及大量工具调用的长时间自主运行的强代理任务中,节省幅度可达约 45%。Anthropic 通过将缓存读取价格从每百万 token 1 美元降至 0.25 美元实现了这一降价。其他 API 价格保持不变,输入和输出仍分别为每百万 token 10 美元和 50 美元。相比之下,Opus 5 的价格只有一半,即每百万 token 输入 5 美元、输出 25 美元。
价格过高是用户对 Fable 5 最大的不满,这也可能导致该模型在企业用户中采用率偏低。价格压力从 7 月底 Opus 5 发布起就在不断积累,当时它就以更低的价格在大多数基准测试中追平或超越了 Fable 5。和之前的 Claude 模型一样,新版本也配备了控制算力使用量的 effort 等级系统。在低或中等 effort 下,Fable 5.1 应能以更低成本取得与 Fable 5 相当的效果。
编码和研究基准测试大幅提升
Fable 5.1 在代理类基准测试中取得了显著进步。在 Terminal-Bench-Science 0.1 上,该模型得分达到 52.6%,是 Fable 5(24.7%)的两倍多,也远超 GPT-5.6 Sol 的 22.4%。在面向代理编码的 Terminal-Bench 4.0 上,Fable 5.1 得分为 55.8%,Mythos 5.1 达到 60.9%,而 Fable 5 为 42.0%,GPT-5.6 Sol 为 37.3%。这些提升能否在同等程度上转化为实际应用中的表现,还需在未来几周内验证。
| Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol | |
|---|---|---|---|---|
| 代理科学研究 Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| 代理编码 Terminal-Bench 4.0 | 55.8% / 60.9%(Mythos 5.1) | 42.0% | 52.3% | 37.3% |
| 知识工作 GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
