DataLearner 标志

DeepSeek-V4-ProvsGLM-5.2

在 21 个共同 benchmark 中,GLM-5.2 整体领先:DeepSeek-V4-Pro 领先 10 项,GLM-5.2 领先 11 项,持平 0 项,平均分差 -10.86。

DeepSeek-AI
DeepSeek-V4-Pro

DeepSeek-AI · 2026-08-13 · 推理大模型

智谱AI
GLM-5.2

智谱AI · 2026-06-13 · 推理大模型

DeepSeek-V4-Pro10 项(48%)(52%)11 项GLM-5.2

评测分数

按能力类目分组,每组内按分差大小排列;共 21 项。

法律

DeepSeek-V4-Pro 领先 2/3
评测项DeepSeek-V4-ProGLM-5.2分差
Legal Research Bench40.8717 / 42Max (With Tools)31.2529 / 42Max (With Tools)+9.62
Harvey Lab-AA84.4024 / 44Max (With Tools)90.9712 / 44Max (With Tools)-6.57
Harvey's Legal Agent Benchmark7.5015 / 43Max (With Tools)7.0816 / 43Max (With Tools)+0.42

临床工作与医疗决策

胶着 2/2
评测项DeepSeek-V4-ProGLM-5.2分差
MedScribe80.1740 / 66Max (With Tools)83.5331 / 66Max (With Tools)-3.36
MedCode42.4738 / 64Max (With Tools)40.7744 / 64Max (With Tools)+1.70

科学知识与推理

胶着 2/2
评测项DeepSeek-V4-ProGLM-5.2分差
CritPt0.90162 / 204Normal (No Tools)3.10114 / 204Normal (No Tools)-2.20
GPQA Diamond72.90168 / 253Normal (No Tools)71.21173 / 253Normal (No Tools)+1.69

跨能力综合测试

胶着 2/2
评测项DeepSeek-V4-ProGLM-5.2分差
SuperCLUE70.106 / 13Reported best (effort unspecified)63.2710 / 13Reported best (effort unspecified)+6.83
LiveBench71.5732 / 117Normal (No Tools)73.1821 / 117Normal (No Tools)-1.61

金融

胶着 2/2
评测项DeepSeek-V4-ProGLM-5.2分差
EMB (Excel Modeling)52.8033 / 42Max (With Tools)61.5324 / 42Max (With Tools)-8.73
Finance Agent v250.3929 / 43Max (With Tools)49.7031 / 43Max (With Tools)+0.69

写作与创意表达

GLM-5.2 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
Creative Writing1,55350 / 110Normal (No Tools)1,75725 / 110Normal (No Tools)-203.30

常识推理

GLM-5.2 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
SimpleBench50.9053 / 96Normal (No Tools)58.8039 / 96Normal (No Tools)-7.90

数学

GLM-5.2 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
FrontierMath Tier 4 v22.4437 / 42Max (No Tools)29.2720 / 42Max (No Tools)-26.83

文档与图表理解

DeepSeek-V4-Pro 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
GDP.pdf13.4066 / 122Max (No Tools)10.4082 / 122Max (No Tools)+3

科学计算与科研编程

GLM-5.2 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
SciCode50.8068 / 134Max (No Tools)51.2067 / 134Max (No Tools)-0.40

程序生成与编辑

DeepSeek-V4-Pro 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
Vibe Code Bench v1.182.3014 / 61Max (With Tools)63.9631 / 61Max (With Tools)+18.34

维护、优化与工程管理

DeepSeek-V4-Pro 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
Code Migration41.5420 / 43Max (With Tools)37.8722 / 43Max (With Tools)+3.67

自主开发与终端任务

DeepSeek-V4-Pro 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
Terminal-Bench 4.014.6046 / 98Max (With Tools)186 / 98Max (With Tools)+13.60

跨应用与工具编排

GLM-5.2 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
PinchBench v261.0732 / 45Reported best (effort unspecified)86.985 / 45Reported best (effort unspecified)-25.91

跨能力聚合指数

GLM-5.2 领先 1/1
评测项DeepSeek-V4-ProGLM-5.2分差
Vals Index52.3729 / 42Max (With Tools)53.1227 / 42Max (With Tools)-0.75

规格对比

字段DeepSeek-V4-ProGLM-5.2
发布机构DeepSeek-AI智谱AI
发布时间2026-08-132026-06-13
模型类型推理大模型推理大模型
架构MoE 架构MoE 架构
参数规模1.6万亿7533.3亿
上下文长度1M1M
最大输出384K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项DeepSeek-V4-ProGLM-5.2
文本输入$0.435 / 1M tokens$1.4 / 1M tokens
文本输出$0.87 / 1M tokens$4.4 / 1M tokens
缓存读取$0.003625 / 1M tokens$0.26 / 1M tokens

小结

  • DeepSeek-V4-Pro在以下类目领先:法律 (2/3)、文档与图表理解 (1/1)、程序生成与编辑 (1/1)、维护、优化与工程管理 (1/1)、自主开发与终端任务 (1/1)
  • GLM-5.2在以下类目领先:写作与创意表达 (1/1)、常识推理 (1/1)、数学 (1/1)、科学计算与科研编程 (1/1)、跨应用与工具编排 (1/1)、跨能力聚合指数 (1/1)
  • 胶着类目:临床工作与医疗决策、科学知识与推理、跨能力综合测试、金融

21 个共同 benchmark 上,GLM-5.2 平均高出 10.86 分。

单项差距最大的 benchmark:Creative Writing — DeepSeek-V4-Pro 1,553,GLM-5.2 1,757(分差 -203.30)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。