DataLearner 标志

Claude Sonnet 5vsGLM-5.2

在 20 个共同 benchmark 中,Claude Sonnet 5 整体领先:Claude Sonnet 5 领先 14 项,GLM-5.2 领先 5 项,持平 1 项,平均分差 +5.77。

Anthropic
Claude Sonnet 5

Anthropic · 2026-06-30 · 多模态大模型

智谱AI
GLM-5.2

智谱AI · 2026-06-13 · 推理大模型

Claude Sonnet 514 项(70%)持平1(25%)5 项GLM-5.2

评测分数

按能力类目分组,每组内按分差大小排列;共 20 项。

法律

GLM-5.2 领先 2/3
评测项Claude Sonnet 5GLM-5.2分差
Legal Research Bench41.8314 / 42Max (With Tools)31.2529 / 42Max (With Tools)+10.58
Harvey's Legal Agent Benchmark523 / 43Max (With Tools)7.0816 / 43Max (With Tools)-2.08
Harvey Lab-AA90.0714 / 44Max (With Tools)90.9712 / 44Max (With Tools)-0.90

临床工作与医疗决策

胶着 2/2
评测项Claude Sonnet 5GLM-5.2分差
MedScribe76.0553 / 66Max (With Tools)83.5331 / 66Max (With Tools)-7.48
MedCode47.5424 / 64Max (With Tools)40.7744 / 64Max (With Tools)+6.77

金融

Claude Sonnet 5 领先 2/2
评测项Claude Sonnet 5GLM-5.2分差
EMB (Excel Modeling)66.3216 / 42Max (With Tools)61.5324 / 42Max (With Tools)+4.79
Finance Agent v253.9120 / 43Max (With Tools)49.7031 / 43Max (With Tools)+4.21

仓库修复与多文件工程

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
DeepSWE5457 / 92Deep Thinking (With Tools)4474 / 92Deep Thinking (With Tools)+10

写作与创意表达

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
Creative Writing1,79424 / 110Normal (No Tools)1,75725 / 110Normal (No Tools)+37.50

多轮记忆与持续上下文

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
Context Arena79.5340 / 126Max (No Tools)72.3458 / 126Max (No Tools)+7.19

客服与业务流程

GLM-5.2 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
τ³-Banking15.70107 / 167Normal (With Tools)16.70102 / 167Normal (With Tools)-1

常识推理

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
SimpleBench60.6035 / 96Normal (No Tools)58.8039 / 96Normal (No Tools)+1.80

数学

胶着 1/1
评测项Claude Sonnet 5GLM-5.2分差
FrontierMath Tier 4 v229.2720 / 42Max (No Tools)29.2720 / 42Max (No Tools)持平

文档与图表理解

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
GDP.pdf13.2068 / 122Max (No Tools)10.4082 / 122Max (No Tools)+2.80

机器学习工程

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
WeirdML v268.7820 / 52Thinking High (With Tools)67.3121 / 52Thinking High (With Tools)+1.47

科学知识与推理

GLM-5.2 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
CritPt1.10151 / 204Normal (No Tools)3.10114 / 204Normal (No Tools)-2

程序生成与编辑

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
Vibe Code Bench v1.181.3316 / 61Max (With Tools)63.9631 / 61Max (With Tools)+17.37

维护、优化与工程管理

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
Code Migration44.3916 / 43Max (With Tools)37.8722 / 43Max (With Tools)+6.52

自主开发与终端任务

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
Terminal-Bench 4.012.4255 / 98Max (With Tools)186 / 98Max (With Tools)+11.42

跨能力聚合指数

Claude Sonnet 5 领先 1/1
评测项Claude Sonnet 5GLM-5.2分差
Vals Index59.6115 / 42Max (With Tools)53.1227 / 42Max (With Tools)+6.49

规格对比

字段Claude Sonnet 5GLM-5.2
发布机构Anthropic智谱AI
发布时间2026-06-302026-06-13
模型类型多模态大模型推理大模型
架构稠密模型MoE 架构
参数规模暂无数据7533.3亿
上下文长度1M1M
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Claude Sonnet 5GLM-5.2
文本输入$2 / 1M tokens$1.4 / 1M tokens
文本输出$10 / 1M tokens$4.4 / 1M tokens
缓存读取$0.2 / 1M tokens$0.26 / 1M tokens
缓存写入$2.5 / 1M tokens暂无公开价格

小结

  • Claude Sonnet 5在以下类目领先:金融 (2/2)、仓库修复与多文件工程 (1/1)、写作与创意表达 (1/1)、多轮记忆与持续上下文 (1/1)、常识推理 (1/1)、文档与图表理解 (1/1)、机器学习工程 (1/1)、程序生成与编辑 (1/1)、维护、优化与工程管理 (1/1)、自主开发与终端任务 (1/1)、跨能力聚合指数 (1/1)
  • GLM-5.2在以下类目领先:法律 (2/3)、客服与业务流程 (1/1)、科学知识与推理 (1/1)
  • 胶着类目:临床工作与医疗决策、数学

20 个共同 benchmark 上,Claude Sonnet 5 平均高出 5.77 分。

单项差距最大的 benchmark:Creative Writing — Claude Sonnet 5 1,794,GLM-5.2 1,757(分差 +37.50)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。