DataLearner 标志
CL

Claude Fable 5.1

承诺至少可用至 2027-09-01推理大模型编程大模型FableClaude 5.1

Claude Fable 5.1

别名:Mythos 5.1

发布时间: 2026-09-01更新于: 2026-09-18知识截止: 2026-06承诺至少可用至: 2027-09-01浏览量: 3,595
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
1M
多语言支持
支持
推理能力
暂无数据

Claude Fable 5.1 是 Anthropic 于 2026 年 9 月 1 日发布的普遍可用旗舰模型,面向高难推理、长周期智能体编程、研究与复杂知识工作。官方规格为 1M 上下文、128K 最大输出,支持文本与图像输入、文本输出,始终启用自适应思考。API 价格为每百万 token 输入 $10、输出 $50,缓存读取降至 $0.25。参数量与训练算力未公开。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Claude Fable 5.1

模型基本信息

推理过程
支持
思考模式
思考水平 · 自适应思考 (Adaptive Thinking) (默认)
上下文长度
1M tokens
最大输出长度
128K tokens
模型类型
推理大模型
输入/输出模态
文本、图像 → 文本
发布时间
2026-09-01
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
2026-06
Claude Fable 5.1

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
Claude Fable 5.1

官方介绍与博客

DataLearnerAI博客
暂无
Claude Fable 5.1

API接口信息

接口速度
暂无数据
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$10.00/ 1M tokens$50.00/ 1M tokens
批量模式
类型适用条件输入输出
文本-$5.00/ 1M tokens$25.00/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本5m$12.50/ 1M tokens$0.250/ 1M tokens
文本1h$20.00/ 1M tokens—

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Claude Fable 5.1

评测结果

Claude Fable 5.1 当前已收录的代表性评测结果包括 HLE(2 / 235,得分 65)、ECI(2 / 167,得分 165)、SciCode(2 / 134,得分 63.10)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

抽象归纳与泛化

共 11 项评测
评测名称 / 模式
得分
排名/总数
90
74 / 193
94.50
38 / 193
96
30 / 193
ARC-AGI-1
最高
97.50
11 / 193
ARC-AGI-1
极高
96.50
24 / 193
78.33
41 / 181
86.25
26 / 181
88.75
20 / 181
ARC-AGI-2
最高
90
13 / 181
ARC-AGI-2
极高
90
13 / 181
ARC-AGI-2
极高工具
90
13 / 181

综合知识考试

共 5 项评测
评测名称 / 模式
得分
排名/总数
94
1 / 1
MILU
最高
93
1 / 1
HLE
最高
60.90
9 / 235
HLE
最高工具
65
2 / 235
HLE
极高
46.50
53 / 235

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
2162
2 / 110

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleBench
思考模式
86.60
2 / 96

仓库修复与多文件工程

共 6 项评测
评测名称 / 模式
得分
排名/总数
99.10
2 / 10
92.20
2 / 11
89.10
2 / 30
81.20
1 / 62
DeepSWE
最高工具
67.40
32 / 92
54.70
1 / 1

跨应用与工具编排

共 2 项评测
评测名称 / 模式
得分
排名/总数
MCP-Atlas
最高工具
87.20
3 / 44
77.80
2 / 14

桌面工作流

共 1 项评测
评测名称 / 模式
得分
排名/总数
OSWorld 2.0
最高工具
77.90
2 / 14

程序生成与编辑

共 4 项评测
评测名称 / 模式
得分
排名/总数
90.26
4 / 61
Program Bench
最高工具
87.60
1 / 15
63.60
3 / 7
50.90
6 / 11

办公与文档流程

共 3 项评测
评测名称 / 模式
得分
排名/总数
OfficeQA
最高工具
80.20
1 / 1
Office QA Pro
最高工具
69
1 / 5
AutomationBench
最高工具
31.40
20 / 25

科学知识与推理

共 6 项评测
评测名称 / 模式
得分
排名/总数
MysteryMechanism
最高工具
47.75
3 / 13
27.70
19 / 204
29.10
12 / 204
30.30
8 / 204
CritPt
最高
29.70
11 / 204
CritPt
极高
31.10
5 / 204

科学计算与科研编程

共 6 项评测
评测名称 / 模式
得分
排名/总数
56.70
23 / 134
56.40
27 / 134
58.70
13 / 134
SciCode
最高
63.10
2 / 134
SciCode
极高
60.90
4 / 134
40
4 / 18

客服与业务流程

共 7 项评测
评测名称 / 模式
得分
排名/总数
74.90
2 / 26
SAGE
最高工具
48.53
20 / 64
τ³-Banking
低工具
39
37 / 167
τ³-Banking
中工具
41
29 / 167
τ³-Banking
高工具
43.10
24 / 167
τ³-Banking
最高工具
47.20
10 / 167
τ³-Banking
极高工具
45.80
14 / 167

法律

共 7 项评测
评测名称 / 模式
得分
排名/总数
Harvey Lab-AA
低工具
92.33
10 / 44
Harvey Lab-AA
中工具
92.65
8 / 44
Harvey Lab-AA
高工具
92.95
7 / 44
Harvey Lab-AA
最高工具
93.02
6 / 44
Harvey Lab-AA
极高工具
93.27
5 / 44
55.29
1 / 42
6.67
17 / 43

金融

共 3 项评测
评测名称 / 模式
得分
排名/总数
Tax Agent Bench
最高工具
77.64
1 / 20
76.67
1 / 42
Finance Agent v2
最高工具
58.88
7 / 43

自主开发与终端任务

共 11 项评测
评测名称 / 模式
得分
排名/总数
CursorBench 3.2
最高工具
73.40
1 / 5
45.10
7 / 43
46.80
4 / 43
49.20
3 / 43
CursorBench 4.0
最高工具
51.80
1 / 43
CursorBench 4.0
极高工具
51.60
2 / 43

文档与图表理解

共 7 项评测
评测名称 / 模式
得分
排名/总数
42.60
11 / 11
Chartography
最高工具
86.20
2 / 11
28
7 / 122
26.80
11 / 122
26.80
11 / 122
GDP.pdf
最高
26.20
14 / 122
GDP.pdf
极高
26.20
14 / 122

专业数据分析

共 1 项评测
评测名称 / 模式
得分
排名/总数
AA-AnalystAgent
最高工具联网
57.50
2 / 29

医学知识与健康咨询

共 3 项评测
评测名称 / 模式
得分
排名/总数

临床工作与医疗决策

共 3 项评测
评测名称 / 模式
得分
排名/总数
MedScribe
最高工具
91.29
2 / 66
74.20
1 / 2
MedCode
最高工具
53.51
6 / 64

机器学习工程

共 1 项评测
评测名称 / 模式
得分
排名/总数

编码综合评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
62.20
1 / 11

维护、优化与工程管理

共 1 项评测
评测名称 / 模式
得分
排名/总数
Code Migration
最高工具
54.61
6 / 43

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
IOI (Vals v2)
最高工具
90.78
4 / 26

数学

共 2 项评测
评测名称 / 模式
得分
排名/总数
100
1 / 28
0
2 / 5

多轮记忆与持续上下文

共 1 项评测
评测名称 / 模式
得分
排名/总数
EBR-bench
最高工具
57.14
3 / 23

和其他模型对比

Claude Fable 5.1

发布机构

Claude Fable 5.1

模型解读

正式发布与定位

Claude Fable 5.1 是 Anthropic 于 2026 年 9 月 1 日正式发布的通用旗舰模型,API ID 为 claude-fable-5-1。它与受邀开放的 Claude Mythos 5.1 使用同一底层模型,但安全防护范围不同。Anthropic 将它定位为面向高难推理、长周期智能体编程、多阶段研究和复杂知识工作的最强普遍可用 Claude 模型。

规格与能力

官方规格为 1M token 上下文、128K token 最大输出,支持文本与图像输入、文本输出,可靠知识与训练数据截止均为 2026 年 6 月。自适应思考始终开启,默认 effort 为 high。模型参数量、训练算力与权重架构未公开,因此相关字段不作估计。

价格、安全与数据边界

标准 API 价格为每百万 token 输入 $10、输出 $50;5 分钟缓存写入 $12.50、1 小时缓存写入 $20、缓存读取/刷新 $0.25,Batch API 输入输出五折。美国境内推理使用 1.1 倍输入输出价格。Fable 5.1 默认要求 30 天数据留存用于安全监控;符合 Enterprise Frontier Safeguards 条件的企业可使用客户控制的云存储与相应零数据保留安排。网络安全和生物领域的部分高风险请求会回退至 Opus 模型。

官方评测

Anthropic 公布 Terminal-Bench-Science 0.1 52.6%、Terminal-Bench 4.0 55.8%、GDPval-AA v2 1853、OSWorld 2.0(2026-08 任务集)partial 77.9%/strict 41.7%(同一批任务下 Opus 5 为 75.4%/39.6%)、Humanity's Last Exam 无工具 60.9%/带工具 65.0%、AutomationBench 31.4%、CursorBench 3.2.0 73.4%。这些是生产安全防护开启条件下的厂商结果;智能体成绩受到工具、脚手架和 effort 影响。

官方来源

Claude Fable 5.1

常见问题

Claude Fable 5.1 适合什么任务?

适合高难推理、跨代码库编程、长周期无人值守智能体、多阶段研究和复杂办公文档工作流。

上下文和最大输出是多少?

官方文档给出 1,000,000 token 上下文和 128,000 token 最大输出。

API 价格是多少?

标准价格为每百万 token 输入 10 美元、输出 50 美元;缓存读取为 0.25 美元,Batch API 输入输出五折。

能关闭思考模式吗?

不能。自适应思考始终开启,通过 effort 调节推理深度,默认 effort 为 high。

是否开源?

不开源,Anthropic 未公开权重、参数规模或训练算力。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码