Hy3vsQwen3.7 Max
在 5 个共同 benchmark 中,Qwen3.7 Max 整体领先:Hy3 领先 2 项,Qwen3.7 Max 领先 3 项,持平 0 项,平均分差 -5.29。
Hy3
腾讯AI实验室 · 2026-07-06 · 推理大模型
Qwen3.7 Max
阿里巴巴 · 2026-05-20 · 推理大模型
Hy32 项(40%)(60%)3 项Qwen3.7 Max
评测分数
按能力类目分组,每组内按分差大小排列;共 5 项。
多轮记忆与持续上下文
Qwen3.7 Max 领先 1/1| 评测项 | Hy3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| Context Arena | 25.35118 / 126Normal (No Tools) | 56.0179 / 126Normal (No Tools) | -30.66 |
客服与业务流程
Hy3 领先 1/1| 评测项 | Hy3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| τ³-Banking | 22.9084 / 167Thinking (With Tools) | 11.80128 / 167Thinking (With Tools) | +11.10 |
文档与图表理解
Hy3 领先 1/1| 评测项 | Hy3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| GDP.pdf | 11.2077 / 122Thinking (No Tools) | 8.6089 / 122Thinking (No Tools) | +2.60 |
科学知识与推理
Qwen3.7 Max 领先 1/1| 评测项 | Hy3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| CritPt | 4.90102 / 204Thinking (No Tools) | 13.4063 / 204Thinking (No Tools) | -8.50 |
自主开发与终端任务
Qwen3.7 Max 领先 1/1| 评测项 | Hy3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| Terminal-Bench 4.0 | 0.5093 / 98Thinking (With Tools) | 1.5083 / 98Thinking (With Tools) | -1 |
规格对比
| 字段 | Hy3 | Qwen3.7 Max |
|---|---|---|
| 发布机构 | 腾讯AI实验室 | 阿里巴巴 |
| 发布时间 | 2026-07-06 | 2026-05-20 |
| 模型类型 | 推理大模型 | 推理大模型 |
| 架构 | MoE 架构 | 稠密模型 |
| 参数规模 | 2950亿 | 暂无数据 |
| 上下文长度 | 256K | 1M |
| 最大输出 | 暂无数据 | 64K |
API 调用价格
价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。
| 价格项 | Hy3 | Qwen3.7 Max |
|---|---|---|
| 文本输入 | ¥1.2 / 1M tokens | ¥12 / 1M tokens |
| 文本输出 | ¥4 / 1M tokens | ¥36 / 1M tokens |
| 缓存读取 | ¥0.4 / 1M tokens | 暂无公开价格 |
小结
- Hy3在以下类目领先:客服与业务流程 (1/1)、文档与图表理解 (1/1)
- Qwen3.7 Max在以下类目领先:多轮记忆与持续上下文 (1/1)、科学知识与推理 (1/1)、自主开发与终端任务 (1/1)
5 个共同 benchmark 上,Qwen3.7 Max 平均高出 5.29 分。
单项差距最大的 benchmark:Context Arena — Hy3 25.35,Qwen3.7 Max 56.01(分差 -30.66)。
本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。