DataLearner 标志

MiniMax M3vsQwen3.7 Max

在 11 个共同 benchmark 中,Qwen3.7 Max 整体领先:MiniMax M3 领先 4 项,Qwen3.7 Max 领先 7 项,持平 0 项,平均分差 -3.58。

MiniMaxAI
MiniMax M3

MiniMaxAI · 2026-06-01 · 多模态大模型

阿里巴巴
Qwen3.7 Max

阿里巴巴 · 2026-05-20 · 推理大模型

MiniMax M34 项(36%)(64%)7 项Qwen3.7 Max

评测分数

按能力类目分组,每组内按分差大小排列;共 11 项。

自主开发与终端任务

胶着 2/2
评测项MiniMax M3Qwen3.7 Max分差
Terminal Bench Hard42.4045 / 244Thinking (With Tools)50.8022 / 244Thinking (With Tools)-8.40
Terminal-Bench 4.0279 / 98Thinking (With Tools)1.5083 / 98Thinking (With Tools)+0.50

专业数据分析

Qwen3.7 Max 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
AA-AnalystAgent1025 / 29Thinking (With Tools + Internet)18.7519 / 29Thinking (With Tools + Internet)-8.75

仓库修复与多文件工程

Qwen3.7 Max 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
SWE-Bench Pro - Public5916 / 62Thinking (With Tools)60.6015 / 62Thinking (With Tools)-1.60

客服与业务流程

MiniMax M3 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
τ³-Banking15.30110 / 167Thinking (With Tools)11.80128 / 167Thinking (With Tools)+3.50

文档与图表理解

MiniMax M3 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
GDP.pdf9.8086 / 122Thinking (No Tools)8.6089 / 122Thinking (No Tools)+1.20

法律

MiniMax M3 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
Harvey Lab-AA88.4115 / 44Thinking (With Tools)83.4326 / 44Thinking (With Tools)+4.98

科学知识与推理

Qwen3.7 Max 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
CritPt3.70111 / 204Thinking (No Tools)13.4063 / 204Thinking (No Tools)-9.70

综合偏好评测

Qwen3.7 Max 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
Text Arena (Coding)1,52814 / 35Normal (No Tools)1,54111 / 35Normal (No Tools)-13.02

跨应用与工具编排

Qwen3.7 Max 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
MCP-Atlas74.2027 / 44Thinking (With Tools)76.4021 / 44Thinking (With Tools)-2.20

跨能力综合测试

Qwen3.7 Max 领先 1/1
评测项MiniMax M3Qwen3.7 Max分差
LiveBench67.2649 / 117Deep Thinking (No Tools)73.1422 / 117Deep Thinking (No Tools)-5.88

规格对比

字段MiniMax M3Qwen3.7 Max
发布机构MiniMaxAI阿里巴巴
发布时间2026-06-012026-05-20
模型类型多模态大模型推理大模型
架构MoE 架构稠密模型
参数规模4280亿暂无数据
上下文长度1M1M
最大输出512K64K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项MiniMax M3Qwen3.7 Max
文本输入¥2.1 / 1M tokens¥12 / 1M tokens
文本输出¥8.4 / 1M tokens¥36 / 1M tokens
缓存读取¥0.42 / 1M tokens暂无公开价格

小结

  • MiniMax M3在以下类目领先:客服与业务流程 (1/1)、文档与图表理解 (1/1)、法律 (1/1)
  • Qwen3.7 Max在以下类目领先:专业数据分析 (1/1)、仓库修复与多文件工程 (1/1)、科学知识与推理 (1/1)、综合偏好评测 (1/1)、跨应用与工具编排 (1/1)、跨能力综合测试 (1/1)
  • 胶着类目:自主开发与终端任务

11 个共同 benchmark 上,Qwen3.7 Max 平均高出 3.58 分。

单项差距最大的 benchmark:Text Arena (Coding) — MiniMax M3 1,528,Qwen3.7 Max 1,541(分差 -13.02)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。