MiniMax M3vsQwen3.7 Max
在 11 个共同 benchmark 中,Qwen3.7 Max 整体领先:MiniMax M3 领先 4 项,Qwen3.7 Max 领先 7 项,持平 0 项,平均分差 -3.58。
MiniMax M3
MiniMaxAI · 2026-06-01 · 多模态大模型
Qwen3.7 Max
阿里巴巴 · 2026-05-20 · 推理大模型
MiniMax M34 项(36%)(64%)7 项Qwen3.7 Max
评测分数
按能力类目分组,每组内按分差大小排列;共 11 项。
自主开发与终端任务
胶着 2/2| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| Terminal Bench Hard | 42.4045 / 244Thinking (With Tools) | 50.8022 / 244Thinking (With Tools) | -8.40 |
| Terminal-Bench 4.0 | 279 / 98Thinking (With Tools) | 1.5083 / 98Thinking (With Tools) | +0.50 |
专业数据分析
Qwen3.7 Max 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| AA-AnalystAgent | 1025 / 29Thinking (With Tools + Internet) | 18.7519 / 29Thinking (With Tools + Internet) | -8.75 |
仓库修复与多文件工程
Qwen3.7 Max 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| SWE-Bench Pro - Public | 5916 / 62Thinking (With Tools) | 60.6015 / 62Thinking (With Tools) | -1.60 |
客服与业务流程
MiniMax M3 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| τ³-Banking | 15.30110 / 167Thinking (With Tools) | 11.80128 / 167Thinking (With Tools) | +3.50 |
文档与图表理解
MiniMax M3 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| GDP.pdf | 9.8086 / 122Thinking (No Tools) | 8.6089 / 122Thinking (No Tools) | +1.20 |
法律
MiniMax M3 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| Harvey Lab-AA | 88.4115 / 44Thinking (With Tools) | 83.4326 / 44Thinking (With Tools) | +4.98 |
科学知识与推理
Qwen3.7 Max 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| CritPt | 3.70111 / 204Thinking (No Tools) | 13.4063 / 204Thinking (No Tools) | -9.70 |
综合偏好评测
Qwen3.7 Max 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| Text Arena (Coding) | 1,52814 / 35Normal (No Tools) | 1,54111 / 35Normal (No Tools) | -13.02 |
跨应用与工具编排
Qwen3.7 Max 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| MCP-Atlas | 74.2027 / 44Thinking (With Tools) | 76.4021 / 44Thinking (With Tools) | -2.20 |
跨能力综合测试
Qwen3.7 Max 领先 1/1| 评测项 | MiniMax M3 | Qwen3.7 Max | 分差 |
|---|---|---|---|
| LiveBench | 67.2649 / 117Deep Thinking (No Tools) | 73.1422 / 117Deep Thinking (No Tools) | -5.88 |
规格对比
| 字段 | MiniMax M3 | Qwen3.7 Max |
|---|---|---|
| 发布机构 | MiniMaxAI | 阿里巴巴 |
| 发布时间 | 2026-06-01 | 2026-05-20 |
| 模型类型 | 多模态大模型 | 推理大模型 |
| 架构 | MoE 架构 | 稠密模型 |
| 参数规模 | 4280亿 | 暂无数据 |
| 上下文长度 | 1M | 1M |
| 最大输出 | 512K | 64K |
API 调用价格
价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。
| 价格项 | MiniMax M3 | Qwen3.7 Max |
|---|---|---|
| 文本输入 | ¥2.1 / 1M tokens | ¥12 / 1M tokens |
| 文本输出 | ¥8.4 / 1M tokens | ¥36 / 1M tokens |
| 缓存读取 | ¥0.42 / 1M tokens | 暂无公开价格 |
小结
- MiniMax M3在以下类目领先:客服与业务流程 (1/1)、文档与图表理解 (1/1)、法律 (1/1)
- Qwen3.7 Max在以下类目领先:专业数据分析 (1/1)、仓库修复与多文件工程 (1/1)、科学知识与推理 (1/1)、综合偏好评测 (1/1)、跨应用与工具编排 (1/1)、跨能力综合测试 (1/1)
- 胶着类目:自主开发与终端任务
11 个共同 benchmark 上,Qwen3.7 Max 平均高出 3.58 分。
单项差距最大的 benchmark:Text Arena (Coding) — MiniMax M3 1,528,Qwen3.7 Max 1,541(分差 -13.02)。
本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。