DataLearner 标志
HA

Haiku 4.5

承诺至少可用至 2026-10-15多模态大模型HaikuClaude 4.5

Claude Haiku 4.5

发布时间: 2025-10-15更新于: 2026-09-18承诺至少可用至: 2026-10-15浏览量: 1,652
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
200K
多语言支持
支持
推理能力
4/5

Haiku 4.5 是Anthropic于 2025-10-15 发布的多模态大模型。支持文本、图像输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Haiku 4.5

模型基本信息

推理过程
支持
思考模式
常规模式 (默认)思考模式
上下文长度
200K tokens
最大输出长度
64K tokens
模型类型
多模态大模型
输入/输出模态
文本、图像 → 文本
发布时间
2025-10-15
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
暂无数据
Haiku 4.5

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
Haiku 4.5

官方介绍与博客

Haiku 4.5

API接口信息

接口速度
5/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$1.00/ 1M tokens$5.00/ 1M tokens
图像-$1.00/ 1M tokens—
批量模式
类型适用条件输入输出
文本-$0.500/ 1M tokens$2.50/ 1M tokens
图像-$0.500/ 1M tokens—
缓存定价Prompt缓存
类型有效期写入读取
文本-$1.25/ 1M tokens$0.100/ 1M tokens
图像-$1.25/ 1M tokens
缓存状态 = write
—
图像-—$0.100/ 1M tokens
缓存状态 = hit

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Haiku 4.5

评测结果

Haiku 4.5 当前已收录的代表性评测结果包括 AIME2025(21 / 110,得分 96.30)、MedScribe(20 / 66,得分 85.23)、Terminal-Bench(11 / 35,得分 41)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合知识考试

共 4 项评测
评测名称 / 模式
得分
排名/总数
MMLU-Pro
常规模式
76
84 / 175
MMLU-Pro
扩展
80
65 / 175
HLE
常规模式
4.30
231 / 235
HLE
扩展
9.70
197 / 235

抽象归纳与泛化

共 4 项评测
评测名称 / 模式
得分
排名/总数
ARC-AGI-1
常规模式
14.30
181 / 193
ARC-AGI-1
扩展
47.67
145 / 193
ARC-AGI-2
常规模式
1.30
167 / 181
ARC-AGI-2
扩展
4.50
145 / 181

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
60.50
210 / 253
73.30
165 / 253

仓库修复与多文件工程

共 4 项评测
评测名称 / 模式
得分
排名/总数
SWE-bench Verified
常规模式工具
60.60
82 / 116
73.30
49 / 116
39.45
58 / 62
25.50
11 / 11

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
62
73 / 125

数学

共 4 项评测
评测名称 / 模式
得分
排名/总数
80.70
66 / 110
AIME2025
128K工具
96.30
21 / 110
FrontierMath
常规模式
4.10
41 / 60
2.10
56 / 80

自主开发与终端任务

共 4 项评测
评测名称 / 模式
得分
排名/总数
Terminal-Bench
常规模式工具
26
26 / 35
41
11 / 35
Terminal Bench Hard
常规模式工具
27.30
120 / 244
Terminal Bench Hard
思考模式工具
27.30
120 / 244

图像感知与视觉推理

共 3 项评测
评测名称 / 模式
得分
排名/总数
MMMU
128K
73.20
40 / 74
MMMU-Pro
常规模式
55.10
190 / 229
MMMU-Pro
思考模式
58.60
181 / 229

客服与业务流程

共 3 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench
常规模式工具
33
43 / 44
SAGE
思考模式工具
31.82
53 / 64
τ³-Banking
思考模式工具
9.30
137 / 167

指令与格式遵循

共 1 项评测
评测名称 / 模式
得分
排名/总数
IF Bench
扩展
54.30
28 / 31

跨能力综合测试

共 2 项评测
评测名称 / 模式
得分
排名/总数
LiveBench
常规模式
45.33
105 / 117
61.32
66 / 117

多轮记忆与持续上下文

共 2 项评测
评测名称 / 模式
得分
排名/总数
Context Arena
常规模式
17.68
124 / 126
Context Arena
思考模式
36.27
103 / 126

跨应用与工具编排

共 4 项评测
评测名称 / 模式
得分
排名/总数
Claw Bench
思考模式工具
89.40
11 / 29
Pinch Bench
思考模式工具
82
22 / 38
67.70
28 / 45
MCP-Atlas
常规模式工具
40.20
44 / 44

跨能力聚合指数

共 2 项评测
评测名称 / 模式
得分
排名/总数
ECI
unknown
142.42
88 / 167
Vals Index
思考模式工具
22.90
39 / 42

科学计算与科研编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SciCode
思考模式
42.20
102 / 134

法律

共 3 项评测
评测名称 / 模式
得分
排名/总数
Harvey Lab-AA
思考模式工具
61.05
36 / 44
Legal Research Bench
思考模式工具
10.58
39 / 42
0.83
33 / 43

金融

共 2 项评测
评测名称 / 模式
得分
排名/总数
Finance Agent v2
思考模式工具
31.01
41 / 43
EMB (Excel Modeling)
思考模式工具
22.66
39 / 42

文档与图表理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
GDP.pdf
思考模式
3.80
103 / 122

专业数据分析

共 1 项评测
评测名称 / 模式
得分
排名/总数
AA-AnalystAgent
思考模式工具联网
15
21 / 29

维护、优化与工程管理

共 1 项评测
评测名称 / 模式
得分
排名/总数
Code Migration
思考模式工具
7.55
38 / 43

程序生成与编辑

共 1 项评测
评测名称 / 模式
得分
排名/总数
Vibe Code Bench v1.1
思考模式工具
11.39
55 / 61

临床工作与医疗决策

共 2 项评测
评测名称 / 模式
得分
排名/总数
MedScribe
思考模式工具
85.23
20 / 66
MedCode
思考模式工具
32.68
57 / 64

和其他模型对比

Haiku 4.5

发布机构

Claude Haiku 4.5

模型解读

Claude Haiku 4.5的详情可以看DataLearnerAI的博客: https://www.datalearner.com/blog/1051760883300903 

Claude Haiku 4.5 由 Anthropic 发布,是 Claude 4.5 系列中主打速度与成本效率的轻量模型,面向实时与高并发应用场景。官方声明其在编码、计算机操作与多代理工作流等任务上的综合表现可与 Sonnet 4 接近,同时具备显著更低的延迟与更优的成本效率。

架构与技术规格(公开信息)

官方未披露参数量与训练数据细节。上下文窗口为 200K tokens。Haiku 4.5 支持文本与图像输入(Text & Image Input),输出为文本。

核心能力与支持模态

(1)文本与代码:面向高并发与低延迟的对话、摘要、代码生成与辅助开发等任务;(2)工具/计算机使用与多代理工作流:强调在复杂工作流中保持稳定响应与自纠错能力;(3)图像理解:支持图像作为输入并进行文本层面的理解与推断(输出为文本)。

性能与基准

官方模型页显示 Haiku 4.5 在 SWE-bench Verified 上得分 73.3%(方法学细节与试验设置见新闻稿附注),并在编码、计算机使用与代理式任务上与 Sonnet 4 保持同级表现。

应用场景与限制

典型应用包括:实时客服/客服代理、低时延对话助手、代码子代理(在多代理系统中的并行子任务执行)、金融数据监控与分析、研究类子代理等。官方系统卡显示该模型在安全评估后以 ASL-2 发布;仍应遵循使用政策并在高风险领域实施必要的人类监督。

访问方式与许可

支持通过 Anthropic API 直接调用(模型名 claude-haiku-4-5),并已在 Amazon Bedrock、Google Cloud Vertex AI 上线。定价(开发者平台)为:$1/百万输入 token、$5/百万输出 token;提示词缓存(Prompt Caching)写入 $1.25/百万 token、读取 $0.10/百万 token(5 分钟 TTL)。模型未开源。

Haiku 4.5

常见问题

Haiku 4.5 是什么模型?

Haiku 4.5 是Anthropic于 2025-10-15 发布的多模态大模型。支持文本、图像输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

Haiku 4.5 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像输入,并生成文本输出。

Haiku 4.5 的上下文窗口和最大输出是多少?

上下文窗口为 200K,最大输出为 64K。未公开或无法确认的规格不做推测。

Haiku 4.5 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型、多语言相关任务;实际效果应结合具体工作流验证。

Haiku 4.5 是否提供 API,价格如何查看?

页面已收录 Anthropic 的 8 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

Haiku 4.5 是否开源?

代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码