DataLearner 标志

Gemma 4 31BvsGLM-5

在 7 个共同 benchmark 中,GLM-5 整体领先:Gemma 4 31B 领先 0 项,GLM-5 领先 7 项,持平 0 项,平均分差 -38.19。

Google DeepMind
Gemma 4 31B

Google DeepMind · 2026-04-02 · 聊天大模型

智谱AI
GLM-5

智谱AI · 2026-02-11 · 聊天大模型

Gemma 4 31B0 项(0%)(100%)7 项GLM-5

评测分数

按能力类目分组,每组内按分差大小排列;共 7 项。

科学知识与推理

GLM-5 领先 2/2
评测项Gemma 4 31BGLM-5分差
GPQA Diamond84.3096 / 253Thinking (No Tools)8680 / 253Thinking (No Tools)-1.70
CritPt1.40139 / 204Thinking (No Tools)2131 / 204Thinking (No Tools)-0.60

写作与创意表达

GLM-5 领先 1/1
评测项Gemma 4 31BGLM-5分差
Creative Writing1,36870 / 110Normal (No Tools)1,60142 / 110Normal (No Tools)-232.40

客服与业务流程

GLM-5 领先 1/1
评测项Gemma 4 31BGLM-5分差
τ²-Bench76.9020 / 44Thinking (With Tools)89.704 / 44Thinking (With Tools)-12.80

数学

GLM-5 领先 1/1
评测项Gemma 4 31BGLM-5分差
AIME 202689.2026 / 30Thinking (No Tools)92.7019 / 30Thinking (No Tools)-3.50

自主开发与终端任务

GLM-5 领先 1/1
评测项Gemma 4 31BGLM-5分差
Terminal Bench Hard30.30110 / 244Normal (With Tools)39.4053 / 244Normal (With Tools)-9.10

跨能力综合测试

GLM-5 领先 1/1
评测项Gemma 4 31BGLM-5分差
LiveBench61.6264 / 117Normal (No Tools)68.8543 / 117Normal (No Tools)-7.23

规格对比

字段Gemma 4 31BGLM-5
发布机构Google DeepMind智谱AI
发布时间2026-04-022026-02-11
模型类型聊天大模型聊天大模型
架构稠密模型MoE 架构
参数规模307亿7440亿
上下文长度256K200K
最大输出32K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Gemma 4 31BGLM-5
文本输入暂无公开价格$1 / 1M tokens
文本输出暂无公开价格$3.2 / 1M tokens
缓存读取暂无公开价格$0.2 / 1M tokens

部分模型公开价格不完整,缺失字段按"暂无公开价格"展示。

小结

  • GLM-5在以下类目领先:科学知识与推理 (2/2)、写作与创意表达 (1/1)、客服与业务流程 (1/1)、数学 (1/1)、自主开发与终端任务 (1/1)、跨能力综合测试 (1/1)

7 个共同 benchmark 上,GLM-5 平均高出 38.19 分。

单项差距最大的 benchmark:Creative Writing — Gemma 4 31B 1,368,GLM-5 1,601(分差 -232.40)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。