DataLearner 标志

Qwen 3.6 Plus PreviewvsKimi K2.5

在 12 个共同 benchmark 中,Qwen 3.6 Plus Preview 整体领先:Qwen 3.6 Plus Preview 领先 12 项,Kimi K2.5 领先 0 项,持平 0 项,平均分差 +4.93。

阿里巴巴
Qwen 3.6 Plus Preview

阿里巴巴 · 2026-03-31 · 聊天大模型

Moonshot AI
Kimi K2.5

Moonshot AI · 2026-01-27 · 多模态大模型

Qwen 3.6 Plus Preview12 项(100%)(0%)0 项Kimi K2.5

评测分数

按能力类目分组,每组内按分差大小排列;共 12 项。

仓库修复与多文件工程

Qwen 3.6 Plus Preview 领先 2/2
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
SWE-bench Verified78.8021 / 116Thinking (With Tools)76.8030 / 116Thinking (With Tools)+2
SWE-bench Multilingual73.8014 / 30Thinking (No Tools)7318 / 30Thinking (No Tools)+0.80

数学

Qwen 3.6 Plus Preview 领先 2/2
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
AIME 202695.3013 / 30Thinking (No Tools)92.5022 / 30Thinking (No Tools)+2.80
IMO-AnswerBench83.8014 / 24Thinking (No Tools)81.8018 / 24Thinking (No Tools)+2

综合知识考试

Qwen 3.6 Plus Preview 领先 2/2
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
MMLU-Pro88.506 / 175Thinking (No Tools)78.5071 / 175Thinking (No Tools)+10
HLE50.6038 / 235Thinking (With Tools)50.2041 / 235Thinking (With Tools)+0.40

客服与业务流程

Qwen 3.6 Plus Preview 领先 1/1
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
τ³-Banking20.8090 / 167Thinking (With Tools)14.20115 / 167Thinking (With Tools)+6.60

科学知识与推理

Qwen 3.6 Plus Preview 领先 1/1
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
GPQA Diamond90.4037 / 253Thinking (No Tools)87.6065 / 253Thinking (No Tools)+2.80

算法与竞赛编程

Qwen 3.6 Plus Preview 领先 1/1
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
LiveCodeBench87.1014 / 125Thinking (No Tools)8520 / 125Thinking (No Tools)+2.10

自主开发与终端任务

Qwen 3.6 Plus Preview 领先 1/1
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
Terminal Bench 2.061.6016 / 48Thinking (With Tools)50.8035 / 48Thinking (With Tools)+10.80

跨应用与工具编排

Qwen 3.6 Plus Preview 领先 1/1
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
PinchBench v272.5023 / 45Reported best (effort unspecified)54.6036 / 45Reported best (effort unspecified)+17.90

跨长文理解与整合

Qwen 3.6 Plus Preview 领先 1/1
评测项Qwen 3.6 Plus PreviewKimi K2.5分差
LongBench v2624 / 14Normal (No Tools)616 / 14Normal (No Tools)+1

规格对比

字段Qwen 3.6 Plus PreviewKimi K2.5
发布机构阿里巴巴Moonshot AI
发布时间2026-03-312026-01-27
模型类型聊天大模型多模态大模型
架构稠密模型MoE 架构
参数规模暂无数据1万亿
上下文长度1M256K
最大输出64K16K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Qwen 3.6 Plus PreviewKimi K2.5
文本输入$0.5 / 1M tokens$0.6 / 1M tokens
文本输出$3 / 1M tokens$3 / 1M tokens
缓存读取$0.05 / 1M tokens$0.1 / 1M tokens
缓存写入$0.625 / 1M tokens暂无公开价格

小结

  • Qwen 3.6 Plus Preview在以下类目领先:仓库修复与多文件工程 (2/2)、数学 (2/2)、综合知识考试 (2/2)、客服与业务流程 (1/1)、科学知识与推理 (1/1)、算法与竞赛编程 (1/1)、自主开发与终端任务 (1/1)、跨应用与工具编排 (1/1)、跨长文理解与整合 (1/1)

12 个共同 benchmark 上,Qwen 3.6 Plus Preview 平均高出 4.93 分。

单项差距最大的 benchmark:PinchBench v2 — Qwen 3.6 Plus Preview 72.50,Kimi K2.5 54.60(分差 +17.90)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。