Claude Fable 5.1

GPT-5.6 Sol 发布没多久,Anthropic 又推出了 Claude Fable 5.1。 性能确实更强,但这次更值得看的不是跑分,而是价格:基础 Token 价格没变,缓存读取直接降了 75%。 对真正拿 API 跑复杂任务的人,这比 benchmark 再涨几个点更实在。
Advertisement 728 × 90
公司Anthropic
上下文1M
发布日期2026-09
更新日期2026-09-03

Claude Fable 5.1 概述

Claude Fable 5.1 是 Anthropic 新一代旗舰模型,主要面向复杂推理、编程、科研和 Agent 工作流。

如果只是让它改封邮件、写个摘要,其实有点浪费。

它更适合那种任务链很长的工作:读代码、查问题、调工具、重新验证,再接着往下做,可能一跑就是几小时。

有个案例挺能说明问题。

一家投资机构被一个极少见的系统崩溃折腾了四五年。工程师换过,其他模型也试过,问题一直没挖出来。

Fable 5.1 接手后,直接去反编译第三方库,又对核心转储做比对,最后发现 Bug 出在第三方库本身。

这就有点像查案了。

不是“你问一句,它答一句”,而是模型自己顺着线索往下挖,发现一条路不对,再换下一条。

这代还支持最高 100 万 Token 的上下文窗口。大型代码库、长文档、连续任务都能装得更多。

一起发布的还有 Mythos 5.1。

它和 Fable 5.1 底子接近,但放宽了部分安全限制,只向经过审核的安全和生命科学机构开放

Claude Fable 5.1 定价

套餐价格说明
输入 Token 10 美元 与 Fable 5 相同
输出 Token 50 美元 与 Fable 5 相同
缓存读取 0.25 美元 原价 1 美元,降了 75%

缓存读取:这次真砍了

上一代缓存读取是 1 美元 / 百万 Token

Fable 5.1 变成 0.25 美元 / 百万 Token

直接砍到四分之一。

缓存可以理解成模型已经读过、后面还要反复用的上下文。

比如让一个 Agent 连续处理大型代码库,它没必要每一步都按完整输入价格重新吃一遍同样的文件。只要能复用缓存,账单就会明显好看一点。

Anthropic 给出的测算是,普通业务场景总成本大约能省 25%;Agent 化程度很高的复杂任务,最高能省 45%

Claude Fable 5.1 主要功能

1. 科研能力涨得有点猛

Terminal-Bench-Science 上,Fable 5.1 拿到了 52.6%

上一代 Fable 5 是 24.7%

这不是多了三五个百分点,而是直接翻了一倍还多。

它做的也不是“解释一下什么是蛋白质”这种知识问答,而是真正要调工具的科研任务。

官方给出的案例包括蛋白质设计、GPU 内核优化,还有拿 NASA 的历史数据去做高精度金星地图。

后面这个挺夸张,分辨率提高了接近 10 倍。

这类任务难就难在不能只靠背答案。模型要自己调用工具、检查结果、发现问题,再继续改。

偶尔一步做对不难,连续几十步别掉链子才难。

2. 编程和自动化工作流更强

在 Terminal-Bench 4.0 和 AutomationBench 上,Fable 5.1 相比前代都有明显提升。

这里有个比跑分更值得看的点:推理档位。

Anthropic 给出的数据里,Fable 5.1 在中低推理档位,就能做到接近上一代高推理档位的表现。

这对开发者很现实。

模型能力强不强是一回事,每次任务烧多少 Token 又是另一回事。

如果不用次次把推理强度拉满,就能把原先需要高档位做的任务跑下来,那省下来的可不是一点。

3. 真能连续“上班”很久

Ramp 做过一次挺狠的测试:让 Fable 5.1 连续跑了 38 个小时

谁平时没事让 AI 连跑 38 小时?

普通用户肯定不会。

但做 Agent、自动化业务、数据实验的团队,还真有这种需求。

这 38 个小时里,模型不是一直等人喂下一步指令。它会自己发现问题、修正数据、启动实验,最后把结果整理成报告。

这才是长任务里最麻烦的地方。

跑三个步骤没问题,跑到第三十步还能记得自己为什么在做这件事,就不是一个量级了。

4. 写东西终于没那么爱“排版”

这个改动不大,但用得多的人应该挺有感。

有研究人员提到,Fable 5.1 写作时少了一些滥用粗体、标题和列表的情况,对风格要求也更听话了。

AI 写长文有个老毛病:一句话能说完,非得拆成三个小标题、五个 bullet,最后再来个“总结”。

看着特别像在交作业。

Fable 5.1 在这方面收了一点。

不是说它突然会写文学作品了,只是少了一些那种一眼就能看出来的“AI 排版癖”。

相比上一代 Fable 5,变了什么?

Fable 5 更像一个很聪明的解题模型。

到了 5.1,Anthropic 明显更在意另一件事:模型能不能把活从头做到尾。

不是只给一个漂亮答案。

而是查问题、用工具、回头检查、继续跑,必要时自己修正。

再配上这次缓存读取降价,路线其实很清楚——Fable 5.1 就是冲着那些真正拿 Claude 当“数字员工”用的人去的。

总结

Fable 5.1 的优势没什么好绕的。

科研和编程更强了,长任务更稳,100 万 Token 上下文也够大。缓存读取从 1 美元砍到 0.25 美元,对 Agent 和大型代码库任务尤其友好。

但别看到“降价”两个字就以为所有东西都便宜了。

输入还是 10 美元,输出还是 50 美元。短任务没多少缓存可复用,成本变化很有限。推理强度拉到最高以后,输出 Token 甚至可能达到上一代的 1.7 倍,单次任务总花费也可能反而贵约 20%。

所以这次升级挺挑人。

如果你天天跟复杂代码、科研任务、自动化业务流打交道,Fable 5.1 很值得看。尤其是原本就有大量 Prompt Cache 的项目,这波降价是真的能反映到账单上。

如果只是偶尔让 AI 写封邮件、做个总结、查点资料,那就别被“旗舰”两个字带着跑。

你根本用不到它最贵的那部分能力,也没必要替那部分能力买单。

评论(0)

发表评论

Advertisement 728 × 90

Anthropic 模型对比

模型 上下文 定价 API 发布 全球热度
Claude Fable 5.1
1M $10.000 / $50.000 per 1M YES 2026-09
1M $5.000 / $25.000 per 1M YES 2026-07
100/100
1M 付费 YES 2026-06
93/100
1M 付费 YES 2026-06
95/100
1M 付费 YES 2026-05
98/100

类似模型

关联工具

相关新闻