DataLearner 标志

GPT-5.6 TerravsGLM-5.2

在 19 个共同 benchmark 中,GPT-5.6 Terra 整体领先:GPT-5.6 Terra 领先 13 项,GLM-5.2 领先 6 项,持平 0 项,平均分差 +11.47。

OpenAI
GPT-5.6 Terra

OpenAI · 2026-06-26 · 推理大模型

智谱AI
GLM-5.2

智谱AI · 2026-06-13 · 推理大模型

GPT-5.6 Terra13 项(68%)(32%)6 项GLM-5.2

评测分数

按能力类目分组,每组内按分差大小排列;共 19 项。

法律

GLM-5.2 领先 2/3
评测项GPT-5.6 TerraGLM-5.2分差
Legal Research Bench41.3515 / 42Max (With Tools)31.2529 / 42Max (With Tools)+10.10
Harvey's Legal Agent Benchmark0.8333 / 43Max (With Tools)7.0816 / 43Max (With Tools)-6.25
Harvey Lab-AA85.1820 / 44Max (With Tools)90.9712 / 44Max (With Tools)-5.79

临床工作与医疗决策

胶着 2/2
评测项GPT-5.6 TerraGLM-5.2分差
MedCode43.4134 / 64Max (With Tools)40.7744 / 64Max (With Tools)+2.64
MedScribe82.8735 / 66Max (With Tools)83.5331 / 66Max (With Tools)-0.66

科学知识与推理

胶着 2/2
评测项GPT-5.6 TerraGLM-5.2分差
GPQA Diamond77.27148 / 253Normal (No Tools)71.21173 / 253Normal (No Tools)+6.06
CritPt2131 / 204Normal (No Tools)3.10114 / 204Normal (No Tools)-1.10

金融

GPT-5.6 Terra 领先 2/2
评测项GPT-5.6 TerraGLM-5.2分差
Finance Agent v254.4417 / 43Max (With Tools)49.7031 / 43Max (With Tools)+4.74
EMB (Excel Modeling)66.2017 / 42Max (With Tools)61.5324 / 42Max (With Tools)+4.67

写作与创意表达

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
Creative Writing1,85514 / 110Normal (No Tools)1,75725 / 110Normal (No Tools)+98.40

多轮记忆与持续上下文

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
Context Arena92.1711 / 126Max (No Tools)72.3458 / 126Max (No Tools)+19.83

客服与业务流程

GLM-5.2 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
τ³-Banking15.70107 / 167Normal (With Tools)16.70102 / 167Normal (With Tools)-1

数学

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
FrontierMath Tier 4 v270.738 / 42Max (No Tools)29.2720 / 42Max (No Tools)+41.46

机器学习工程

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
WeirdML v278.2710 / 52Thinking High (With Tools)67.3121 / 52Thinking High (With Tools)+10.96

科学计算与科研编程

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
SciCode5539 / 134Max (No Tools)51.2067 / 134Max (No Tools)+3.80

程序生成与编辑

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
Vibe Code Bench v1.174.5923 / 61Max (With Tools)63.9631 / 61Max (With Tools)+10.63

维护、优化与工程管理

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
Code Migration47.808 / 43Max (With Tools)37.8722 / 43Max (With Tools)+9.93

自主开发与终端任务

GPT-5.6 Terra 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
Terminal-Bench 4.021.5236 / 98Max (With Tools)186 / 98Max (With Tools)+20.52

跨应用与工具编排

GLM-5.2 领先 1/1
评测项GPT-5.6 TerraGLM-5.2分差
PinchBench v275.8916 / 45Reported best (effort unspecified)86.985 / 45Reported best (effort unspecified)-11.09

规格对比

字段GPT-5.6 TerraGLM-5.2
发布机构OpenAI智谱AI
发布时间2026-06-262026-06-13
模型类型推理大模型推理大模型
架构稠密模型MoE 架构
参数规模暂无数据7533.3亿
上下文长度1.05M1M
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GPT-5.6 TerraGLM-5.2
文本输入$2 / 1M tokens$1.4 / 1M tokens
文本输出$12 / 1M tokens$4.4 / 1M tokens
缓存读取$0.2 / 1M tokens$0.26 / 1M tokens
缓存写入$2.5 / 1M tokens暂无公开价格

小结

  • GPT-5.6 Terra在以下类目领先:金融 (2/2)、写作与创意表达 (1/1)、多轮记忆与持续上下文 (1/1)、数学 (1/1)、机器学习工程 (1/1)、科学计算与科研编程 (1/1)、程序生成与编辑 (1/1)、维护、优化与工程管理 (1/1)、自主开发与终端任务 (1/1)
  • GLM-5.2在以下类目领先:法律 (2/3)、客服与业务流程 (1/1)、跨应用与工具编排 (1/1)
  • 胶着类目:临床工作与医疗决策、科学知识与推理

19 个共同 benchmark 上,GPT-5.6 Terra 平均高出 11.47 分。

单项差距最大的 benchmark:Creative Writing — GPT-5.6 Terra 1,855,GLM-5.2 1,757(分差 +98.40)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。