DataLearner 标志

Hy3vsQwen3.7 Max

在 5 个共同 benchmark 中,Qwen3.7 Max 整体领先:Hy3 领先 2 项,Qwen3.7 Max 领先 3 项,持平 0 项,平均分差 -5.29。

腾讯AI实验室
Hy3

腾讯AI实验室 · 2026-07-06 · 推理大模型

阿里巴巴
Qwen3.7 Max

阿里巴巴 · 2026-05-20 · 推理大模型

Hy32 项(40%)(60%)3 项Qwen3.7 Max

评测分数

按能力类目分组,每组内按分差大小排列;共 5 项。

多轮记忆与持续上下文

Qwen3.7 Max 领先 1/1
评测项Hy3Qwen3.7 Max分差
Context Arena25.35118 / 126Normal (No Tools)56.0179 / 126Normal (No Tools)-30.66

客服与业务流程

Hy3 领先 1/1
评测项Hy3Qwen3.7 Max分差
τ³-Banking22.9084 / 167Thinking (With Tools)11.80128 / 167Thinking (With Tools)+11.10

文档与图表理解

Hy3 领先 1/1
评测项Hy3Qwen3.7 Max分差
GDP.pdf11.2077 / 122Thinking (No Tools)8.6089 / 122Thinking (No Tools)+2.60

科学知识与推理

Qwen3.7 Max 领先 1/1
评测项Hy3Qwen3.7 Max分差
CritPt4.90102 / 204Thinking (No Tools)13.4063 / 204Thinking (No Tools)-8.50

自主开发与终端任务

Qwen3.7 Max 领先 1/1
评测项Hy3Qwen3.7 Max分差
Terminal-Bench 4.00.5093 / 98Thinking (With Tools)1.5083 / 98Thinking (With Tools)-1

规格对比

字段Hy3Qwen3.7 Max
发布机构腾讯AI实验室阿里巴巴
发布时间2026-07-062026-05-20
模型类型推理大模型推理大模型
架构MoE 架构稠密模型
参数规模2950亿暂无数据
上下文长度256K1M
最大输出暂无数据64K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Hy3Qwen3.7 Max
文本输入¥1.2 / 1M tokens¥12 / 1M tokens
文本输出¥4 / 1M tokens¥36 / 1M tokens
缓存读取¥0.4 / 1M tokens暂无公开价格

小结

  • Hy3在以下类目领先:客服与业务流程 (1/1)、文档与图表理解 (1/1)
  • Qwen3.7 Max在以下类目领先:多轮记忆与持续上下文 (1/1)、科学知识与推理 (1/1)、自主开发与终端任务 (1/1)

5 个共同 benchmark 上,Qwen3.7 Max 平均高出 5.29 分。

单项差距最大的 benchmark:Context Arena — Hy3 25.35,Qwen3.7 Max 56.01(分差 -30.66)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。