DataLearner 标志
HA

Haiku 4.5

多模态大模型HaikuClaude 4.5

Claude Haiku 4.5

发布时间: 2025-10-15更新于: 2026-07-17 23:18:37.4721,570
在线体验GitHubHugging FaceCompare
模型参数
未披露
上下文长度
200K
中文支持
支持
推理能力

Haiku 4.5 是Anthropic于 2025-10-15 发布的多模态大模型。支持文本、图像输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Haiku 4.5

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
200K tokens
最大输出长度
64K tokens
模型类型
多模态大模型
输入/输出模态
文本、图像 → 文本
发布时间
2025-10-15
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不涉及
知识截止
暂无数据
Haiku 4.5

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无GitHub开源地址
Hugging Face
暂无开源HuggingFace地址
在线体验
Haiku 4.5

官方介绍与博客

Haiku 4.5

API接口信息

接口速度
5/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$1.00/ 1M$5.00/ 1M
批量模式
类型适用条件输入输出
文本-$0.500/ 1M$2.50/ 1M
缓存定价Prompt缓存
类型有效期写入读取
文本-$1.25/ 1M$0.100/ 1M
Haiku 4.5

评测结果

Haiku 4.5 当前已收录的代表性评测结果包括 AIME2025(20 / 107,得分 96.30)、Terminal-Bench(11 / 35,得分 41)、Claw Bench(11 / 29,得分 89.40)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合评估

共 12 项评测
评测名称 / 模式
得分
排名/总数
MMLU Pro
常规模式
76
81 / 132
MMLU Pro
扩展
80
63 / 132
GPQA Diamond
常规模式
60.50
144 / 187
73.30
106 / 187
LiveBench
常规模式
45.33
103 / 115
61.32
64 / 115
ARC-AGI
常规模式
14.30
59 / 68
ARC-AGI
扩展
47.70
46 / 68
HLE
常规模式
4.30
170 / 172
HLE
扩展
9.70
148 / 172
ARC-AGI-2
常规模式
1.30
55 / 62
ARC-AGI-2
扩展
4.50
50 / 62

编程与软件工程

共 5 项评测
评测名称 / 模式
得分
排名/总数
SWE-bench Verified
常规模式工具
60.60
80 / 112
73.30
48 / 112
LiveCodeBench
常规模式
51
93 / 123
62
68 / 123
39.45
51 / 54

数学推理

共 5 项评测
评测名称 / 模式
得分
排名/总数
AIME2025
常规模式
39
95 / 107
80.70
58 / 107
AIME2025
128K工具
96.30
20 / 107
FrontierMath
常规模式
4.10
41 / 60
2.10
56 / 80

AI Agent - 工具使用

共 3 项评测
评测名称 / 模式
得分
排名/总数
Terminal-Bench
常规模式工具
26
26 / 35
41
11 / 35
MCP-Atlas
常规模式工具
40.20
27 / 27

多模态理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
MMMU
128K
73.20
20 / 29

Agent能力评测

共 1 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench
常规模式工具
33
42 / 43

指令跟随

共 1 项评测
评测名称 / 模式
得分
排名/总数
IF Bench
扩展
54.30
26 / 30

OpenClaw智能体能力综合测评

共 2 项评测
评测名称 / 模式
得分
排名/总数
Claw Bench
思考模式工具
89.40
11 / 29
Pinch Bench
思考模式工具
82
21 / 37

和其他模型对比

Haiku 4.5

发布机构

Claude Haiku 4.5

模型解读

Claude Haiku 4.5的详情可以看DataLearnerAI的博客: https://www.datalearner.com/blog/1051760883300903 


Claude Haiku 4.5 由 Anthropic 发布,是 Claude 4.5 系列中主打速度与成本效率的轻量模型,面向实时与高并发应用场景。官方声明其在编码、计算机操作与多代理工作流等任务上的综合表现可与 Sonnet 4 接近,同时具备显著更低的延迟与更优的成本效率。

架构与技术规格(公开信息)

官方未披露参数量与训练数据细节。上下文窗口为 200K tokens。Haiku 4.5 支持文本与图像输入(Text & Image Input),输出为文本。

核心能力与支持模态

(1)文本与代码:面向高并发与低延迟的对话、摘要、代码生成与辅助开发等任务;(2)工具/计算机使用与多代理工作流:强调在复杂工作流中保持稳定响应与自纠错能力;(3)图像理解:支持图像作为输入并进行文本层面的理解与推断(输出为文本)。

性能与基准

官方模型页显示 Haiku 4.5 在 SWE-bench Verified 上得分 73.3%(方法学细节与试验设置见新闻稿附注),并在编码、计算机使用与代理式任务上与 Sonnet 4 保持同级表现。

应用场景与限制

典型应用包括:实时客服/客服代理、低时延对话助手、代码子代理(在多代理系统中的并行子任务执行)、金融数据监控与分析、研究类子代理等。官方系统卡显示该模型在安全评估后以 ASL-2 发布;仍应遵循使用政策并在高风险领域实施必要的人类监督。

访问方式与许可

支持通过 Anthropic API 直接调用(模型名 claude-haiku-4-5),并已在 Amazon Bedrock、Google Cloud Vertex AI 上线。定价(开发者平台)为:$1/百万输入 token$5/百万输出 token;提示词缓存(Prompt Caching)写入 $1.25/百万 token、读取 $0.10/百万 token(5 分钟 TTL)。模型未开源。

Haiku 4.5

常见问题

Haiku 4.5 是什么模型?

Haiku 4.5 是Anthropic于 2025-10-15 发布的多模态大模型。支持文本、图像输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

Haiku 4.5 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像输入,并生成文本输出。

Haiku 4.5 的上下文窗口和最大输出是多少?

上下文窗口为 200K,最大输出为 64K。未公开或无法确认的规格不做推测。

Haiku 4.5 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型、多语言相关任务;实际效果应结合具体工作流验证。

Haiku 4.5 是否提供 API,价格如何查看?

页面已收录 Anthropic 的 8 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

Haiku 4.5 是否开源?

代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码