DataLearner 标志
CL

Claude Fable 5

承诺至少可用至 2027-06-09推理大模型编程大模型FableClaude 5

Claude Fable 5

发布时间: 2026-06-09更新于: 2026-09-18知识截止: 2026-01承诺至少可用至: 2027-06-09浏览量: 10,989
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
1M
多语言支持
支持
推理能力
5/5

Claude Fable 5 是 Anthropic 于 2026 年 6 月 9 日发布的模型,与仅通过 Project Glasswing 开放的 Claude Mythos 5 同规格同价,区别是 Fable 5 带一层会主动拒答的安全分类器(网络安全、生化、蒸馏三类),被拦截的请求回退到 Claude Opus 4.8。它曾因美国出口管制于 6 月 13 日对所有用户暂停,管制在 6 月 30 日解除后已于 7 月 1 日恢复全球访问,目前可正常使用。规格为 1M 上下文、128K 最大输出、知识截止 2026 年 1 月,自适应思考不可关闭且不返回原始思维链,只能用 effort 控制深度;被拒请求不计费。官方成绩 SWE-bench Pro 约 80.3%、SWE-bench Verified 约 95.0%、Terminal-Bench 2.1 约 88.0%。价格为输入 10 美元、输出 50 美元每百万 tokens——需要注意 7 月 24 日发布的 Claude Opus 5 价格减半且 SWE-bench Verified 更高,多数场景下更划算。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Claude Fable 5

模型基本信息

推理过程
支持
思考模式
思考水平 · 自适应思考 (Adaptive Thinking) (默认)
上下文长度
1M tokens
最大输出长度
128K tokens
模型类型
推理大模型
输入/输出模态
文本、图像 → 文本
发布时间
2026-06-09
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
2026-01
Claude Fable 5

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
Claude Fable 5

官方介绍与博客

DataLearnerAI博客
暂无
Claude Fable 5

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$10.00/ 1M tokens$50.00/ 1M tokens
批量模式
类型适用条件输入输出
文本-$5.00/ 1M tokens$25.00/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本5m$12.50/ 1M tokens$1.00/ 1M tokens
文本1h$20.00/ 1M tokens—

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Claude Fable 5

评测结果

Claude Fable 5 当前已收录的代表性评测结果包括 ARC-AGI-1(1 / 193,得分 98.50)、Terminal Bench Hard(2 / 244,得分 62.90)、LiveBench(2 / 117,得分 79.53)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

抽象归纳与泛化

共 11 项评测
评测名称 / 模式
得分
排名/总数
90.50
69 / 193
92.50
52 / 193
95.50
32 / 193
ARC-AGI-1
最高
98.50
1 / 193
ARC-AGI-1
极高
98.50
1 / 193
ARC-AGI-1
极高工具
98.50
1 / 193
76.81
46 / 181
82.50
40 / 181
87.50
23 / 181
ARC-AGI-2
最高
89.17
18 / 181
ARC-AGI-2
极高
88.33
21 / 181

综合知识考试

共 1 项评测
评测名称 / 模式
得分
排名/总数
HLE
深度
59
12 / 235

科学知识与推理

共 4 项评测
评测名称 / 模式
得分
排名/总数
78.79
139 / 253
83.33
102 / 253
85.86
81 / 253
CritPt
最高
28.60
16 / 204

仓库修复与多文件工程

共 9 项评测
评测名称 / 模式
得分
排名/总数
95
2 / 116
SWE-bench Verified
深度工具
95
2 / 116
80.30
2 / 62
DeepSWE
低工具
59.58
49 / 92
DeepSWE
中工具
65.37
40 / 92
DeepSWE
高工具
68.60
27 / 92
DeepSWE
最高工具
69.72
19 / 92
DeepSWE
深度工具
69.91
18 / 92
APEX-SWE
最高工具
58.80
1 / 3

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
1943.10
10 / 110

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleBench
常规模式
81.90
6 / 96

跨能力综合测试

共 2 项评测
评测名称 / 模式
得分
排名/总数
75.47
9 / 117
LiveBench
深度
79.53
2 / 117

自主开发与终端任务

共 7 项评测
评测名称 / 模式
得分
排名/总数
80.45
27 / 57
Terminal-Bench 2.1
极高工具
83.80
23 / 57
Terminal-Bench 2.1
深度工具
88
6 / 57
CursorBench 3.2
最高工具
70.50
2 / 5
62.90
2 / 244
Terminal-Bench 3.0
最高工具
34.10
3 / 11

桌面工作流

共 1 项评测
评测名称 / 模式
得分
排名/总数
85
1 / 28

跨应用与工具编排

共 4 项评测
评测名称 / 模式
得分
排名/总数
MCPMark-Verified
最高工具
86.61
4 / 8
MCP-Atlas
常规模式工具
83.30
8 / 44
APEX-Agents
最高工具
59.20
1 / 7
54.84
35 / 45

跨能力聚合指数

共 5 项评测
评测名称 / 模式
得分
排名/总数

科学计算与科研编程

共 2 项评测
评测名称 / 模式
得分
排名/总数
SciCode
最高
61
3 / 134
21.40
7 / 18

客服与业务流程

共 3 项评测
评测名称 / 模式
得分
排名/总数
70.43
4 / 26
SAGE
最高工具
51.89
7 / 64
τ³-Banking
最高工具
39.69
34 / 167

法律

共 3 项评测
评测名称 / 模式
得分
排名/总数
Harvey Lab-AA
最高工具
93.56
3 / 44
49.52
5 / 42
11.25
8 / 43

金融

共 2 项评测
评测名称 / 模式
得分
排名/总数
73.67
3 / 42
Finance Agent v2
最高工具
56.31
13 / 43

数学

共 4 项评测
评测名称 / 模式
得分
排名/总数
95
5 / 28
87.80
2 / 42
87.02
3 / 58
0
2 / 5

机器学习工程

共 2 项评测
评测名称 / 模式
得分
排名/总数
WeirdML v2
高工具
87.85
3 / 52

图像感知与视觉推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GeoBench ACW
常规模式
89
1 / 20

程序生成与编辑

共 3 项评测
评测名称 / 模式
得分
排名/总数
90.35
2 / 61
64.90
1 / 7
53.50
3 / 11

文档与图表理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
GDP.pdf
最高
24
21 / 122

专业数据分析

共 1 项评测
评测名称 / 模式
得分
排名/总数
AA-AnalystAgent
最高工具联网
48.75
6 / 29

维护、优化与工程管理

共 1 项评测
评测名称 / 模式
得分
排名/总数
Code Migration
最高工具
55.06
5 / 43

临床工作与医疗决策

共 2 项评测
评测名称 / 模式
得分
排名/总数
MedScribe
最高工具
88.52
9 / 66
MedCode
最高工具
56.07
3 / 64

多轮记忆与持续上下文

共 1 项评测
评测名称 / 模式
得分
排名/总数
EBR-bench
最高工具
39.52
7 / 23

和其他模型对比

Claude Fable 5

发布机构

Claude Fable 5

模型解读

Mythos 级模型第一次向公众开放

Claude Fable 5 是 Anthropic 于 2026 年 6 月 9 日发布的模型,官方定位是「面向最苛刻的推理与长周期智能体工作、且已广泛发布的最强 Claude 模型」。它与同期发布的 Claude Mythos 5 共享同一套能力、规格和价格,区别只有一处:Fable 5 带一层会主动拒答的安全分类器,Mythos 5 不带,后者只通过 Project Glasswing 向经过审批的网络安全伙伴和少数生物医药研究者开放。换句话说,普通开发者能拿到的就是 Fable 5,而它并不是「阉割版」,只是多了一道门禁。

Anthropic 给出的三类拦截方向分别是网络安全(阻止漏洞利用与自动化入侵)、生物与化学(阻止两用生物武器研究)以及模型蒸馏(阻止能力抽取)。被拦截的请求会回退到 Claude Opus 4.8 作答,官方称 Opus 4.8 本身仍是相当能打的模型,因此回退并不等于「没有答案」。

一次出口管制引发的下架与回归

这是 Fable 5 最值得单独记一笔的一段经历,也是很多资料至今仍写错的地方。2026 年 6 月 12 日,美国政府对 Fable 5 与 Mythos 5 施加出口管制,要求限制外国公民访问;由于无法实时核验用户国籍,Anthropic 在次日对所有用户暂停了这两个模型。6 月 30 日,相关出口管制被解除,Anthropic 于 7 月 1 日恢复全球访问,并借这次重新部署上线了一个针对 Amazon 研究人员披露的特定越狱手法的新分类器,官方称对该手法的拦截率超过 99%。

因此,本页此前「访问权限已被撤回、当前不可使用」的说法已不再成立——Claude Fable 5 目前可正常访问。订阅侧的过渡安排则是:Pro、Max、Team 与部分 Enterprise 计划在 7 月 7 日前可将每周额度的最多 50% 用在 Fable 5 上,之后改为按用量额度(usage credits)计费。

接入前必须知道的三件事:拒答、回退与计费

安全分类器带来的不是「偶尔说不」,而是 API 行为上的实质变化,官方文档专门要求集成方按三点改造:

  • 拒答不是错误。当 Fable 5 拒绝一个请求时,Messages API 返回的是 HTTP 200 且 stop_reason: "refusal" 的正常响应,并会说明是哪一个分类器拒绝的。把它当异常处理会直接踩坑。
  • 回退有三种做法。服务端回退(传 fallbacks 参数,用官方推荐模型或自己指定,Claude API 上为 beta)、客户端回退(用 SDK 中间件)、以及完全自己实现的手动重试。
  • 被拒的请求不计费。在生成任何输出前被拒绝的请求不收费;换模型重试时,fallback credit 会退还切换带来的提示缓存成本,避免同一份上下文付两次钱。

规格与思考机制:思考关不掉,原始思维链也拿不到

Fable 5 提供 100 万 token 上下文窗口,单次请求最大输出 128K tokens,输入支持文本与图像、输出为文本,知识截止时间为 2026 年 1 月。思考机制上有两个和其它 Claude 模型不同的硬约束:

  • 自适应思考始终开启,不接受 thinking: {"type": "disabled"};要控制思考深度只能用 effort 参数。
  • 原始思维链永不返回。thinking.display 设为 "summarized" 时返回可读的推理摘要,默认值 "omitted" 则返回内容为空的思考块。多轮对话中把思考块原样传回即可。

发布时即支持的能力包括 effort、任务预算(beta)、memory 工具、代码执行、程序化工具调用、上下文编辑中的工具结果清理(beta)、compaction 与视觉输入。另需注意数据留存:Fable 5 与 Mythos 5 均被列为 Covered Models,强制 30 天数据留存,不支持零数据留存(ZDR),这对有合规要求的团队是个硬门槛。

官方评测与真实工程案例

发布时公布的成绩里,最拉开差距的是仓库级软件工程:SWE-bench Pro 约 80.3%,比次优前沿模型高出约 11 分(Claude Opus 4.8 为 69.2%、GPT-5.5 为 58.6%、Gemini 3.1 Pro 为 54.2%);SWE-bench Verified 约 95.0%、Terminal-Bench 2.1 约 88.0%、OSWorld-Verified 约 85.0%、HLE(无工具)约 59.0%。难度更高的 FrontierCode Diamond 上为 29.3%,而 Opus 4.8 只有 13.4%——这一项的倍数差距比总分差距更能说明它在硬问题上的余量。

官方还给了两个可感知的案例:Stripe 用它把一次涉及 5000 万行 Ruby 代码的迁移从人工两个月压缩到一天完成;Mythos 5 在蛋白质设计上把迭代速度提升约 10 倍,其生成的分子生物学研究假设在与 Opus 级模型的盲测比较中约 80% 的情况下更受科学家青睐。

价格、可用平台,以及现在还该不该选它

标准 API 价格为每百万输入 token 10 美元、每百万输出 token 50 美元,官方称这不到 Claude Mythos Preview 的一半。批量调用(Batch API)约五折,为输入 5 美元、输出 25 美元;提示词缓存写入(5 分钟)12.5 美元,缓存读取 1 美元。可用渠道包括 Claude API、Claude.ai、Claude Code、Claude Cowork,以及 Amazon Bedrock、Claude Platform on AWS、Google Cloud(Vertex AI)与 Microsoft Foundry。

选型上有一点值得提醒:Fable 5 发布一个半月后,Anthropic 在 2026 年 7 月 24 日推出了 Claude Opus 5,SWE-bench Verified 官方成绩 96.0% 已略高于 Fable 5 的 95.0%,而价格只有输入 5 美元、输出 25 美元,正好是 Fable 5 的一半,且不带这套会拒答的分类器。因此对绝大多数编码与智能体场景,Opus 5 现在是更划算的默认选择;Fable 5 更适合那些确实吃到它长周期自主执行与视觉推理上限的任务。

官方来源

Claude Fable 5

常见问题

Claude Fable 5 是什么模型?

Claude Fable 5 是 Anthropic 于 2026 年 6 月 9 日发布的 Mythos 级模型中首个公开普遍可用的版本,与受限的 Mythos 5 同源但加入安全防护;具备 100 万 token 上下文,官方称多数基准达到最先进水平,SWE-bench Pro 约 80.3% 领先前沿模型。

Claude Fable 5 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像输入,并生成文本输出。

Claude Fable 5 的上下文窗口和最大输出是多少?

上下文窗口为 1M,最大输出为 128K。未公开或无法确认的规格不做推测。

Claude Fable 5 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型、多语言相关任务;实际效果应结合具体工作流验证。

Claude Fable 5 是否提供 API,价格如何查看?

页面已收录 Anthropic 的 11 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

Claude Fable 5 是否开源?

代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码