
Claude Fable 5.1 与 Mythos 5.1 发布:同一底座、两套护栏,缓存读取降至 $0.25/百万 tokens
Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1:前者已全面可用,后者面向经过审核的网络安全与生命科学用户,缓存读取价格降至每百万 tokens 0.25 美元。
先说结论
Anthropic 在 2026 年 9 月 1 日发布 Claude Fable 5.1 与 Claude Mythos 5.1。两者使用同一底层模型,区别集中在安全护栏:Fable 5.1 已全面可用,Mythos 5.1 只向通过审核的网络安全与生命科学用户开放。12
这次发布对开发者最直接的影响有三点:Fable 5.1 现在可以通过
claude-fable-5-1 调用;输入价格仍为每百万 tokens 10 美元,输出价格为 50 美元,缓存读取降至 0.25 美元;1M 上下文和 128K 最大输出保持在前沿模型的长程任务区间。12| 现在要判断什么 | 已确认的信息 | 动作窗口 |
|---|---|---|
| 是否开始评测 | Fable 5.1 已可通过 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 使用;Mythos 5.1 仍需可信访问资格。12 | API 用户可以立即做一轮长程编码、研究和文档任务对比。 |
| 是否适合替代 Fable 5 | Anthropic 报告了编码、知识工作、电脑操作、科学研究和自动化任务的多项提升;不同 benchmark 的工具、护栏和任务版本各不相同。1 | 先复测自己的任务集,再决定是否切换默认模型。 |
| 是否适合敏感工作 | Fable 5.1 放宽了部分防护误报,Mythos 5.1 为经过审核的网络安全和生命科学工作提供更宽的护栏。1 | 先确认业务属于一般使用、企业隐私场景,还是可信访问计划覆盖的专业场景。 |
两个名字,底层是一款模型
Claude Fable 5.1 是面向一般用户和开发者的版本。Claude Mythos 5.1 使用相同的模型能力,但为经过审核的用户提供更宽松的网络安全和生命科学护栏。Anthropic 将 Mythos 5.1 放入 Cyber Verification Program 和 Life Sciences Verification Program;目前可用范围仍集中在一批美国机构,后续计划扩大到更多国内外合作方。1
因此,Fable 5.1 与 Mythos 5.1 在参数、上下文和价格上属于同一规格线,读者真正需要比较的是任务能否通过护栏,以及团队是否拥有访问资格。Anthropic 官方发布材料和模型文档均未披露参数规模。12
规格、API 与价格
| 项目 | Claude Fable 5.1 | Claude Mythos 5.1 |
|---|---|---|
| 发布时间 | 2026 年 9 月 1 日。2 | 与 Fable 5.1 同期发布。1 |
| 参数规模 | 官方未披露。1 | 与 Fable 5.1 相同,官方未披露。1 |
| API 模型 ID | 模型 ID 为 claude-fable-5-1。1 | 文档显示 Mythos 5.1 与 Fable 5.1 共享规格和价格,通过邀请使用。2 |
| 上下文 / 最大输出 | 1M tokens / 128K tokens。2 | 与 Fable 5.1 相同。2 |
| 思考模式 | Adaptive thinking(自适应思考),始终开启;默认 effort 为 high。2 | 与 Fable 5.1 共享规格。2 |
| 输入 / 输出价格 | 每百万 tokens 10 / 50 美元。2 | 与 Fable 5.1 共享价格。2 |
| 缓存读取 | 每百万 tokens 0.25 美元,比 Fable 5 的缓存读取价格低 75%。1 | 与 Fable 5.1 共享价格。2 |
| 可用范围 | Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS。2 | Project Glasswing 参与者,或通过 Anthropic、AWS、Google Cloud 账户团队申请。2 |
价格变化主要发生在缓存读取。Anthropic 按 2026 年 8 月真实使用数据估算,典型工作负载的总成本约下降 25%,上下文密集、工具调用密集的高度 Agent 化工作最高可下降约 45%。这两个比例属于 Anthropic 的工作负载测算,团队仍需用自己的缓存命中率和调用方式复算。1
benchmark:优势集中在长程任务
以下分数来自 Anthropic 的官方发布页,属于厂商自测结果。不同项目使用了不同的 harness(评测执行框架)、工具权限、effort、超时和任务版本;表格适合用来定位能力重点,不能直接当作统一条件下的总排名。1
| 任务 | Fable 5.1 | 对照值 | 条件与读法 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | Fable 5:24.7% | 科学研究 Agent 任务;每个模型标准误约 ±3.5–4.5 分,Anthropic 复测的 Opus 5 为 29.0%,Fable 5 为 24.7%。1 |
| Terminal-Bench 4.0 | 55.8% | Fable 5:42.0%;Mythos 5.1:60.9% | 终端编码 Agent 任务;Mythos 与 Fable 使用同一底层模型,分数差异反映网络安全护栏在部分任务上的介入。1 |
| GDPval-AA v2 | 1853 | Fable 5:1723;Opus 5:1824 | 知识工作评测,分数来自官方图表。1 |
| OSWorld 2.0,partial | 77.9% | Fable 5:72.9%;Opus 5:75.4% | 电脑操作任务;官方说明任务文件来自 2026 年 8 月版本,不能与更早发布的 OSWorld 结果直接比较。1 |
| Humanity’s Last Exam,with tools | 65.0% | Fable 5:63.8%;Opus 5:63.6% | 开启工具;关闭工具时 Fable 5.1 为 60.9%,Fable 5 为 57.8%。1 |
| AutomationBench | 31.4% | Fable 5:17.1%;Opus 5:26.9% | 企业自动化任务;官方提醒,护栏介入时 Fable 5 在部分任务上记为 0 分。1 |
| CursorBench 3.2.0 | 73.4% | Fable 5:70.5%;Opus 5:70.0% | 编码任务;Anthropic 的图表还列出 GPT-5.6 Sol 为 67.2%。1 |
这组数字指向一个明确的使用场景:长程编码、研究、文档和多步骤 Agent 工作。API 默认使用高 effort,Claude Cowork 与 Claude.ai 默认使用中 effort;Anthropic 表示,在低或中 effort 下,Fable 5.1 也能以更低成本取得接近或高于 Fable 5 的结果。12
科学研究亮点:从回答问题到推进实验链
Anthropic 展示了三类科学研究案例。案例中的结果来自 Anthropic 对模型的测试,其中一部分经过外部实验验证,读者可以把它们当作能力示范和评测线索。
蛋白质设计。 Claude Mythos 5.1 使用开源蛋白质设计和折叠工具生成设计,再交给两家外部机构做实验验证。在 12 个目标上,设计的命中率接近 50%;在其中三个目标上,结合亲和力达到 Adaptyv Bio 蛋白质设计竞赛最佳设计的约 10 倍。Anthropic 同时给出当前蛋白质设计常见命中率约 10%—15% 的背景值。1
金星地形图。 Claude Fable 5.1 根据 NASA 麦哲伦号任务 30 多年前拍摄的雷达图像,以及覆盖金星约五分之一的旧地图,训练神经网络生成覆盖金星约三分之一的新高分辨率地形图。新图把细节尺度从 10—20 公里推进到 2—3 公里,地形高度的准确度最高提升 25%。1


计算生物学。 Claude Mythos 5.1 为 7 个开源蛋白质和基因组学模型编写定制 GPU kernel(GPU 运算核心),并缓存中间结果。在输出保持一致的条件下,推理速度最高提升 2.5 倍;Anthropic 估算,基因组级分析的 GPU 成本可以下降 30%—60%。1
这些案例的共同点是,模型承担了资料处理、工具调用、代码编写、实验设计或结果检查中的连续多步工作。团队评测时,应该把“能否在自己的工具链中完成一整条任务”作为主指标,而不是只复现单轮问答分数。
安全护栏决定了两款模型的实际边界
Fable 5.1 可以用于发现软件漏洞,防护系统仍会把渗透测试、漏洞利用代码生成和基于二进制的漏洞扫描等双重用途任务转交给 Opus 系列。Anthropic 表示,Claude Code 用户在网络安全护栏上的平均干预次数相比 Fable 5 的旧护栏减少约 60%。1
生命科学场景的护栏也有所调整。Fable 5.1 对基础生物学和医学问题的良性请求,误触发率相比 Fable 5 上线时的护栏降低 85%;涉及生命科学研发的请求仍会转向 Opus 模型。Mythos 5.1 则通过 Life Sciences Verification Program 向经过审核的专业人员开放更适合研发工作的生命科学能力。1
企业隐私的关键变化是 Enterprise Frontier Safeguards(EFS,企业前沿安全护栏)。EFS 计划分阶段推出,让客户把数据存储在自己控制的云基础设施中,人工审核默认由客户完成,从而提供相当于零数据留存协议的隐私模式。在 EFS 对企业开放前,符合条件的客户可以先以零数据留存方式使用 Fable 5.1。1
接入前,四类团队分别要检查什么
- 已有 API 调用的团队: 把
claude-fable-5-1加入现有评测,分别记录成功率、端到端耗时、输出 token、缓存命中率和人工复核时间。价格下降主要来自缓存读取,实际收益取决于工作流是否反复复用上下文。1 - 长程编码与 Agent 团队: 把 effort 作为单独变量,比较低、中、高设置下的任务完成率和成本。迁移自 Fable 5 时,还要检查强制工具调用、思考块跨模型复用,以及修改历史轮次后思考块失效等兼容性变化。2
- 网络安全团队: 一般防御性漏洞发现可以先评测 Fable 5.1;渗透测试、漏洞利用生成和二进制漏洞扫描需要预留 Opus 回退路径。需要更宽护栏的合规组织,再查看 Cyber Verification Program 的申请条件。1
- 生命科学与企业合规团队: 生命科学研发用户需要关注 Life Sciences Verification Program 的资格与地区范围;企业需要把 EFS 的推出时间、零数据留存条件和自身云基础设施纳入隐私评估。1
Anthropic 这次发布的核心变化不是增加一个完全不同的模型家族,而是把同一底层能力拆成了两条可用路径:Fable 5.1 面向一般开发和知识工作,Mythos 5.1 面向经过审核的高风险专业场景。对大多数团队,今天就能开始的是 Fable 5.1 的 API 评测;对网络安全、生命科学和高隐私企业,真正需要跟进的是访问资格、护栏范围与数据留存条件。
References
- 1
- 2Claude Platform Docs:Claude Fable 5.1 overview
platform.claude.com
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
