Claude Fable 5.1 正式发布:能力上探,缓存价格降到每百万 token 0.25 美元

Claude Fable 5.1 正式发布:能力上探,缓存价格降到每百万 token 0.25 美元

Claude Fable 5.1 面向复杂长程代理工作正式开放,基础 token 单价不变但缓存读取降价,迁移前仍需检查工具调用、thinking、数据留存和安全回退。

一句话判断

Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1,并将它直接开放给 Claude API 与主要云平台。它把 Fable 5 的长程编码、研究和办公任务能力再往前推了一步,基础输入输出价格保持在每百万 token 10 美元 / 50 美元,但缓存读取降到每百万 token 0.25 美元。12
对已经使用 Fable 5 的团队,Fable 5.1 值得立即做灰度测试。迁移表面上接近即插即用,但强制工具调用、thinking 配置和多轮历史处理都有破坏性变化;对已经使用 Opus 5 的团队,Fable 5.1 的价格和数据留存条件反而更需要先核对。

规格、价格和可用性

项目Claude Fable 5.1
Claude API 模型 ID模型 ID 为 claude-fable-5-13
上下文窗口1M token;官方模型页把它列为默认能力。1
单次最大输出128K token。1
思考方式Adaptive thinking 始终开启;用 effort 控制思考深度。3
默认 efforthigh,即高 effort。1
可靠知识截止时间2026 年 6 月。1
标准价格输入 $10 / MTok,输出 $50 / MTok;与 Fable 5 相同。1
缓存读取$0.25 / MTok,是 Fable 5 价格的四分之一。4
Batch API输入和输出均享受 50% 折扣。4
可用平台Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundry。3
状态Active,latest;官方承诺退休时间不早于 2027 年 9 月 1 日。1
这里有一个容易漏掉的成本变化:降价集中在 cache read,而不是基础 token 单价。5 分钟缓存写入是 $12.50 / MTok,1 小时缓存写入是 $20 / MTok;只有后续命中读取按 $0.25 / MTok 计费。重复发送代码库、长系统提示或项目文档的代理工作,才最容易吃到这项变化。4

Fable 5.1 提升的重点,是把长任务做完

Anthropic 把 Fable 5.1 的重点放在长时间运行的编码代理、多步研究,以及文档、表格和幻灯片工作。模型页也给出了更窄的选型建议:复杂任务先从 Opus 5 开始,只有当 Opus 5 在较高 effort 下仍达不到要求,或者任务确实需要更强的长程推理,再评估 Fable 5.1。1
发布页给出的几组数字,能帮助读者理解它的定位:
评测Fable 5.1Fable 5其他对照条件与边界
Terminal-Bench-Science 0.152.6%24.7%Opus 5:29.0%;GPT-5.6 Sol:22.4%Anthropic 的测试设置;公开榜单与其复现实验存在差异,标准误差为 ±3.5–4.5 个百分点。2
Terminal-Bench 4.055.8%42.0%Mythos 5.1:60.9%这个差距部分来自网络安全防护介入,不等于两个模型底座不同。2
GDPval-AA v218531723Opus 5:1824发布页报告的知识工作评测分数。2
CursorBench 3.2.073.4%70.5%Opus 5:70.0%发布页报告的最高 effort 结果。2
这些结果属于 Anthropic 的发布方评测。它们适合回答「Fable 5.1 想解决什么问题」,不能替代团队自己的成功率、延迟和单任务成本测试。Terminal-Bench-Science 的公开榜单还显示,Opus 5 与 Fable 5 的差距处在复现实验噪声范围内;读者不应把表格理解成跨测试环境的统一排行榜。2

它和 Opus 5、Sonnet 5 的位置不同

模型上下文 / 最大输出标准输入 / 输出价速度与思考更适合先测的任务
Fable 5.11M / 128K$10 / $50较慢;Adaptive thinking 始终开启需要更强长程推理和长时间自主运行的代理工作。1
Opus 51M / 128K$5 / $25中等;支持 Adaptive thinking复杂代理式编码和企业工作,也是官方建议的多数工作负载起点。5
Sonnet 51M / 128K$2 / $10快;支持 Adaptive thinking高频请求、吞吐量和成本优先的生产服务。5
Haiku 4.5200K / 64K$1 / $5最快;Extended thinking上下文较短、响应速度比前沿能力更重要的任务。5
Fable 5.1 的基础价格是 Opus 5 的两倍。它要靠更高的完成率、更少的人工介入,或者缓存读取的大幅下降,才能在真实工作流里证明这笔溢价值得支付。

从 Fable 5 迁移,先查四个破坏点

  1. 强制工具选择会直接返回 400。 Fable 5.1 支持 autonone,但 {type: "any"}{type: "tool", name: "..."} 不再支持。应用可以把工具名称写进用户指令,配合 strict: true 的工具定义;如果原应用只是借强制工具调用来生成结构化 JSON,也可以改用 JSON outputs。3
  2. 手动 thinking 配置不能照搬。 thinking: {type: "disabled"} 和手动 extended thinking 都会返回 400。Fable 5.1 的 adaptive thinking 始终开启,应用要用 effort 控制 token 消耗,并重新检查 max_tokens3
  3. thinking blocks 有模型绑定。 Fable 5.1 能读取 Fable 5、Opus 5 和更早模型产生的 thinking blocks;旧模型读取不了 Fable 5.1 新产生的 blocks。路由回退到旧模型时,API 会丢弃旧模型无法读取的部分。3
  4. 修改早期历史会让后续 thinking 失效。 如果应用自己重建 systemtoolsmessages,删除、重排旧 turn,或者把客户端摘要插回原对话,Fable 5.1 可能返回签名错误。生产集成应保持历史 append-only,或使用服务端 compaction / context editing。3
迁移还要重新测三个行为:长代理循环可能每轮只发一个工具调用;低 effort 下模型更可能凭记忆回答而减少检索调用;工具调用之间的进度文字默认隐藏在 thinking blocks 里。需要这些行为的产品,应重新设计提示和渲染逻辑。3

安全、数据留存和接入建议

Fable 5.1 的安全防护比 Fable 5 更精确。Anthropic 表示,Claude Code 用户每次会话受到网络安全防护干预的平均次数约减少 60%;模型现在可以用于发现软件漏洞,但渗透测试、漏洞利用代码生成和基于二进制的漏洞扫描仍会被导向其他模型。被分类器拒绝的请求可以通过 fallbacks 转到 Opus 4.8 或 Opus 5。23
API 文档的默认条件是 30 天数据留存;没有相应留存设置的组织或 workspace 调用时会收到 400,除非 Anthropic 明确授权例外。Anthropic 同时表示,符合条件的企业客户在 Enterprise Frontier Safeguards 上线前可以使用 zero data retention;这项资格需要向账户团队确认,不能从模型 ID 推断出来。23
接入前可以按下面的顺序做决定:
  1. 用现有任务集比较 Fable 5、Opus 5 和 Fable 5.1 的任务完成率、人工接管次数、工具调用轮数、总 token、首字节延迟和单任务成本。
  2. 把多文件修改、长上下文检索、根因分析、幻灯片生成与安全拒答放进同一套回归测试。
  3. 检查应用是否强制工具、关闭 thinking、编辑历史或依赖旧模型读取新 thinking blocks。
  4. 把缓存命中率和 Batch API 纳入成本模型;只比较 $10 / $50 的名义单价,会漏掉 Fable 5.1 最明显的成本变化。
对复杂长任务,Fable 5.1 已经值得试用;对普通高频请求,Opus 5 或 Sonnet 5 仍然可能拥有更好的成本与速度组合。最终判断取决于 Fable 5.1 是否让你的工作流少需要几轮人工修正,而不是取决于发布页上的最高分。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel