Anthropic 发布 Claude Fable 5.1:1M 上下文,缓存读取降价 75%,SWE-Bench Pro 登顶
12 周内的同代迭代:跑分继续冲顶,真正影响账单的是缓存价格。本文基于多家行业媒体与模型跟踪平台转述整理,官方定价页已作旁证。
一句话先说结论
9 月 1 日,Anthropic 发布新一代旗舰模型 Claude Fable 5.1,接替 6 月发布的 Fable 5。上下文窗口 100 万 tokens,输入/输出价格不变($10 / $50 每百万 tokens),但缓存读取价格降到 $0.25,约为原来 Fable 5 的四分之一。
这是一次什么样的更新?
Fable 5 是 Anthropic 2026 年 Claude 5 代的旗舰通用模型,Fable 5.1 是它在 12 周后的第一次迭代——从命名就能看出,这不是换代,而是“同代加强版”。核心变化有三块:
- Agent 编程能力继续拉开差距:SWE-Bench Pro(真实开源项目修 bug 测试)
81.2%,公开榜第一;多语言版 SWE-Bench89.1%;终端环境执行任务上,Terminal-Bench 4.0 拿到55.8%,科学版 Terminal-Bench-Science52.6%。 - 推理与抽象能力:Humanity's Last Exam 不带工具
60.9%、带工具65%;抽象推理测试 ARC-AGI-2 达到90%。 - 价格结构微调,方向明确:输入 $10、输出 $50 不变,缓存写入不变(5 分钟 $12.5、1 小时 $20),唯独缓存读取从 $1 量级砍到 $0.25 每百万 tokens——其他 Claude 模型按输入价 0.1 倍收费,Fable 5.1 按 0.025 倍收费。
为什么缓存降价对你的影响可能比跑分更大?
跑分是给榜单看的,缓存价格是给账单看的。
如果你在跑 Agent(代码助手、多步研究、文档处理),同一个长上下文会被反复读取。以前读 100 万 tokens 缓存要花约 $100,现在只要 $25——对把大量文档塞进上下文反复问答的场景,这一项就能把实际账单压下去一大截。反过来,如果你只是偶尔调用、几乎不命中缓存,那 5.1 对你的成本基本没影响,该 $10 还是 $10。
谁适合现在就换?
适合:
- 正在用 Fable 5 跑 Agent 工作流的团队——同价换更强的 SWE-Bench Pro 和终端能力,缓存重度用户还能再省一笔;
- 需要 100 万上下文做长文档分析、代码库级问答的开发者——聚合平台 LLM Gateway 已上架,OpenAI 兼容接口可直接调用。
不适合:
- 预算敏感的日常任务:$10/$50 仍是全家族最贵一档,同家族 Claude Opus 5 是 $5/$25、Sonnet 5 更低,轻量任务没必要上旗舰;
- 想等官方发布说明再动手的保守派:本次信息基于多家行业源交叉印证,官方定价页已能查到该模型价格条目,完整发布说明建议以 Anthropic 官方渠道为准。
同场发布的还有一个“你用不到”的模型
与 Fable 5.1 同日,Anthropic 还发布了 Claude Mythos 5.1。这是受限的网络安全专用模型(前代 Mythos 5 就采取审批制开放),普通开发者拿不到 API 权限,了解即可。在终端安全类测试 Terminal-Bench 4.0 上,Mythos 5.1 拿到 60.9%,排第一。
怎么用?
已有 Claude API 账号的开发者,把 model 参数换成 claude-fable-5-1 即可,价格按本文所列执行;没有账号的,可以走聚合平台(如 LLM Gateway)用 OpenAI 兼容接口接入,支持流式、工具调用与结构化输出。