DataLearner 标志

Kimi K3vsGLM-5.2

在 20 个共同 benchmark 中,Kimi K3 整体领先:Kimi K3 领先 18 项,GLM-5.2 领先 2 项,持平 0 项,平均分差 +26.76。

Moonshot AI
Kimi K3

Moonshot AI · 2026-07-16 · 推理大模型

智谱AI
GLM-5.2

智谱AI · 2026-06-13 · 推理大模型

Kimi K318 项(90%)(10%)2 项GLM-5.2

评测分数

按能力类目分组,每组内按分差大小排列;共 20 项。

法律

Kimi K3 领先 3/3
评测项Kimi K3GLM-5.2分差
Legal Research Bench44.2011 / 42Max (With Tools)31.2529 / 42Max (With Tools)+12.95
Harvey's Legal Agent Benchmark10.8310 / 43Max (With Tools)7.0816 / 43Max (With Tools)+3.75
Harvey Lab-AA94.642 / 44Max (With Tools)90.9712 / 44Max (With Tools)+3.67

临床工作与医疗决策

Kimi K3 领先 2/2
评测项Kimi K3GLM-5.2分差
MedCode48.8819 / 64Max (With Tools)40.7744 / 64Max (With Tools)+8.11
MedScribe87.9610 / 66Max (With Tools)83.5331 / 66Max (With Tools)+4.43

仓库修复与多文件工程

Kimi K3 领先 2/2
评测项Kimi K3GLM-5.2分差
SWE-Marathon424 / 7Max (With Tools)137 / 7Max (With Tools)+29
FrontierSWE81.201 / 4Max (With Tools)74.403 / 4Max (With Tools)+6.80

金融

Kimi K3 领先 2/2
评测项Kimi K3GLM-5.2分差
EMB (Excel Modeling)66.4015 / 42Max (With Tools)61.5324 / 42Max (With Tools)+4.87
Finance Agent v254.4018 / 43Max (With Tools)49.7031 / 43Max (With Tools)+4.70

写作与创意表达

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
Creative Writing2,0825 / 110Normal (No Tools)1,75725 / 110Normal (No Tools)+325.80

多轮记忆与持续上下文

GLM-5.2 领先 1/1
评测项Kimi K3GLM-5.2分差
Context Arena71.7559 / 126Max (No Tools)72.3458 / 126Max (No Tools)-0.59

数学

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
FrontierMath Tier 4 v239.0215 / 42Max (No Tools)29.2720 / 42Max (No Tools)+9.76

文档与图表理解

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
GDP.pdf2230 / 122Max (No Tools)10.4082 / 122Max (No Tools)+11.60

机器学习工程

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
PostTrain Bench36.603 / 5Max (With Tools)34.305 / 5Max (With Tools)+2.30

科学计算与科研编程

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
SciCode59.508 / 134Max (No Tools)51.2067 / 134Max (No Tools)+8.30

程序生成与编辑

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
Vibe Code Bench v1.184.9610 / 61Max (With Tools)63.9631 / 61Max (With Tools)+21

维护、优化与工程管理

GLM-5.2 领先 1/1
评测项Kimi K3GLM-5.2分差
Code Migration16.1034 / 43Max (With Tools)37.8722 / 43Max (With Tools)-21.77

综合偏好评测

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
Text Arena (Coding)1,6822 / 35Max (No Tools)1,5935 / 35Max (No Tools)+88.50

跨能力综合测试

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
SuperCLUE70.685 / 13Reported best (effort unspecified)63.2710 / 13Reported best (effort unspecified)+7.41

跨能力聚合指数

Kimi K3 领先 1/1
评测项Kimi K3GLM-5.2分差
Vals Index57.8120 / 42Max (With Tools)53.1227 / 42Max (With Tools)+4.69

规格对比

字段Kimi K3GLM-5.2
发布机构Moonshot AI智谱AI
发布时间2026-07-162026-06-13
模型类型推理大模型推理大模型
架构MoE 架构MoE 架构
参数规模2.8万亿7533.3亿
上下文长度1M1M
最大输出1M128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Kimi K3GLM-5.2
文本输入¥20 / 1M tokens$1.4 / 1M tokens
文本输出¥100 / 1M tokens$4.4 / 1M tokens
缓存读取¥2 / 1M tokens$0.26 / 1M tokens

小结

  • Kimi K3在以下类目领先:法律 (3/3)、临床工作与医疗决策 (2/2)、仓库修复与多文件工程 (2/2)、金融 (2/2)、写作与创意表达 (1/1)、数学 (1/1)、文档与图表理解 (1/1)、机器学习工程 (1/1)、科学计算与科研编程 (1/1)、程序生成与编辑 (1/1)、综合偏好评测 (1/1)、跨能力综合测试 (1/1)、跨能力聚合指数 (1/1)
  • GLM-5.2在以下类目领先:多轮记忆与持续上下文 (1/1)、维护、优化与工程管理 (1/1)

20 个共同 benchmark 上,Kimi K3 平均高出 26.76 分。

单项差距最大的 benchmark:Creative Writing — Kimi K3 2,082,GLM-5.2 1,757(分差 +325.80)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。