DataLearner 标志

MiniMax-M2.7vsKimi K2.5

在 8 个共同 benchmark 中,MiniMax-M2.7 整体领先:MiniMax-M2.7 领先 6 项,Kimi K2.5 领先 2 项,持平 0 项,平均分差 +5.16。

MiniMaxAI
MiniMax-M2.7

MiniMaxAI · 2026-03-18 · 推理大模型

Moonshot AI
Kimi K2.5

Moonshot AI · 2026-01-27 · 多模态大模型

MiniMax-M2.76 项(75%)(25%)2 项Kimi K2.5

评测分数

按能力类目分组,每组内按分差大小排列;共 8 项。

跨应用与工具编排

MiniMax-M2.7 领先 3/3
评测项MiniMax-M2.7Kimi K2.5分差
PinchBench v266.7530 / 45Reported best (effort unspecified)54.6036 / 45Reported best (effort unspecified)+12.15
Claw Bench91.705 / 29Thinking (With Tools)81.7018 / 29Thinking (With Tools)+10
Pinch Bench87.1010 / 38Thinking (With Tools)84.8018 / 38Thinking (With Tools)+2.30

仓库修复与多文件工程

MiniMax-M2.7 领先 1/1
评测项MiniMax-M2.7Kimi K2.5分差
SWE-Bench Pro - Public56.2029 / 62Thinking (With Tools)50.7047 / 62Thinking (With Tools)+5.50

客服与业务流程

Kimi K2.5 领先 1/1
评测项MiniMax-M2.7Kimi K2.5分差
τ³-Banking9.90132 / 167Thinking (With Tools)14.20115 / 167Thinking (With Tools)-4.30

科学知识与推理

Kimi K2.5 领先 1/1
评测项MiniMax-M2.7Kimi K2.5分差
GPQA Diamond8770 / 253Thinking (No Tools)87.6065 / 253Thinking (No Tools)-0.60

自主开发与终端任务

MiniMax-M2.7 领先 1/1
评测项MiniMax-M2.7Kimi K2.5分差
Terminal Bench 2.05725 / 48Thinking (With Tools)50.8035 / 48Thinking (With Tools)+6.20

跨行业工作评估

MiniMax-M2.7 领先 1/1
评测项MiniMax-M2.7Kimi K2.5分差
GDPval-AA507 / 15Thinking (No Tools)409 / 15Thinking (No Tools)+10

规格对比

字段MiniMax-M2.7Kimi K2.5
发布机构MiniMaxAIMoonshot AI
发布时间2026-03-182026-01-27
模型类型推理大模型多模态大模型
架构MoE 架构MoE 架构
参数规模2290亿1万亿
上下文长度200K256K
最大输出200K16K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项MiniMax-M2.7Kimi K2.5
文本输入$0.3 / 1M tokens$0.6 / 1M tokens
文本输出$1.2 / 1M tokens$3 / 1M tokens
缓存读取$0.06 / 1M tokens$0.1 / 1M tokens
缓存写入$0.375 / 1M tokens暂无公开价格

小结

  • MiniMax-M2.7在以下类目领先:跨应用与工具编排 (3/3)、仓库修复与多文件工程 (1/1)、自主开发与终端任务 (1/1)、跨行业工作评估 (1/1)
  • Kimi K2.5在以下类目领先:客服与业务流程 (1/1)、科学知识与推理 (1/1)

8 个共同 benchmark 上,MiniMax-M2.7 平均高出 5.16 分。

单项差距最大的 benchmark:PinchBench v2 — MiniMax-M2.7 66.75,Kimi K2.5 54.60(分差 +12.15)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。