DataLearner 标志

Claude Opus 5vsGLM-5.2

在 17 个共同 benchmark 中,Claude Opus 5 整体领先:Claude Opus 5 领先 16 项,GLM-5.2 领先 1 项,持平 0 项,平均分差 +44.24。

Anthropic
Claude Opus 5

Anthropic · 2026-07-24 · 推理大模型

智谱AI
GLM-5.2

智谱AI · 2026-06-13 · 推理大模型

Claude Opus 516 项(94%)(6%)1 项GLM-5.2

评测分数

按能力类目分组,每组内按分差大小排列;共 17 项。

法律

Claude Opus 5 领先 2/3
评测项Claude Opus 5GLM-5.2分差
Legal Research Bench55.291 / 42Max (With Tools)31.2529 / 42Max (With Tools)+24.04
Harvey Lab-AA93.464 / 44Max (With Tools)90.9712 / 44Max (With Tools)+2.49
Harvey's Legal Agent Benchmark6.6717 / 43Max (With Tools)7.0816 / 43Max (With Tools)-0.41

临床工作与医疗决策

Claude Opus 5 领先 2/2
评测项Claude Opus 5GLM-5.2分差
MedCode63.571 / 64Max (With Tools)40.7744 / 64Max (With Tools)+22.80
MedScribe90.983 / 66Max (With Tools)83.5331 / 66Max (With Tools)+7.45

多轮记忆与持续上下文

Claude Opus 5 领先 2/2
评测项Claude Opus 5GLM-5.2分差
EBR-bench45.715 / 23Max (With Tools)9.5218 / 23Max (With Tools)+36.19
Context Arena97.721 / 126Max (No Tools)72.3458 / 126Max (No Tools)+25.38

金融

Claude Opus 5 领先 2/2
评测项Claude Opus 5GLM-5.2分差
EMB (Excel Modeling)73.564 / 42Max (With Tools)61.5324 / 42Max (With Tools)+12.03
Finance Agent v258.638 / 43Max (With Tools)49.7031 / 43Max (With Tools)+8.93

写作与创意表达

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
Creative Writing2,1333 / 110Normal (No Tools)1,75725 / 110Normal (No Tools)+376.10

数学

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
FrontierMath Tier 4 v273.176 / 42Max (No Tools)29.2720 / 42Max (No Tools)+43.90

文档与图表理解

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
GDP.pdf21.6031 / 122Max (No Tools)10.4082 / 122Max (No Tools)+11.20

科学计算与科研编程

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
SciCode56.4027 / 134Max (No Tools)51.2067 / 134Max (No Tools)+5.20

程序生成与编辑

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
Vibe Code Bench v1.188.406 / 61Max (With Tools)63.9631 / 61Max (With Tools)+24.44

维护、优化与工程管理

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
Code Migration57.473 / 43Max (With Tools)37.8722 / 43Max (With Tools)+19.60

综合偏好评测

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
Text Arena (Coding)1,7121 / 35Max (No Tools)1,5935 / 35Max (No Tools)+118.63

跨能力聚合指数

Claude Opus 5 领先 1/1
评测项Claude Opus 5GLM-5.2分差
Vals Index67.214 / 42Max (With Tools)53.1227 / 42Max (With Tools)+14.09

规格对比

字段Claude Opus 5GLM-5.2
发布机构Anthropic智谱AI
发布时间2026-07-242026-06-13
模型类型推理大模型推理大模型
架构稠密模型MoE 架构
参数规模暂无数据7533.3亿
上下文长度1M1M
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Claude Opus 5GLM-5.2
文本输入$5 / 1M tokens$1.4 / 1M tokens
文本输出$25 / 1M tokens$4.4 / 1M tokens
缓存读取$0.5 / 1M tokens$0.26 / 1M tokens
缓存写入$6.25 / 1M tokens暂无公开价格

小结

  • Claude Opus 5在以下类目领先:法律 (2/3)、临床工作与医疗决策 (2/2)、多轮记忆与持续上下文 (2/2)、金融 (2/2)、写作与创意表达 (1/1)、数学 (1/1)、文档与图表理解 (1/1)、科学计算与科研编程 (1/1)、程序生成与编辑 (1/1)、维护、优化与工程管理 (1/1)、综合偏好评测 (1/1)、跨能力聚合指数 (1/1)

17 个共同 benchmark 上,Claude Opus 5 平均高出 44.24 分。

单项差距最大的 benchmark:Creative Writing — Claude Opus 5 2,133,GLM-5.2 1,757(分差 +376.10)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。