DataLearner 标志

Grok 4.7vsGrok 4.6

在 3 个共同 benchmark 中,Grok 4.7 整体领先:Grok 4.7 领先 3 项,Grok 4.6 领先 0 项,持平 0 项,平均分差 +9.57。

xAI
Grok 4.7

xAI · 2026-09-21 · 编程大模型

xAI
Grok 4.6

xAI · 2026-08-12 · 编程大模型

Grok 4.73 项(100%)(0%)0 项Grok 4.6

评测分数

按能力类目分组,每组内按分差大小排列;共 3 项。

法律

Grok 4.7 领先 1/1
评测项Grok 4.7Grok 4.6分差
Harvey Lab-AA19.6042 / 44Thinking High (With Tools)15.8043 / 44Thinking High (With Tools)+3.80

科学计算与科研编程

Grok 4.7 领先 1/1
评测项Grok 4.7Grok 4.6分差
Terminal-Bench-Science 0.114.309 / 18Extra-High (With Tools)7.1014 / 18Extra-High (With Tools)+7.20

自主开发与终端任务

Grok 4.7 领先 1/1
评测项Grok 4.7Grok 4.6分差
Terminal-Bench 4.03822 / 98Thinking High (With Tools)20.3038 / 98Thinking High (With Tools)+17.70

规格对比

字段Grok 4.7Grok 4.6
发布机构xAIxAI
发布时间2026-09-212026-08-12
模型类型编程大模型编程大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度500K500K
最大输出暂无数据暂无数据

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Grok 4.7Grok 4.6
文本输入$2 / 1M tokens$2 / 1M tokens
文本输出$6 / 1M tokens$6 / 1M tokens
缓存读取$0.5 / 1M tokens$0.5 / 1M tokens

小结

  • Grok 4.7在以下类目领先:法律 (1/1)、科学计算与科研编程 (1/1)、自主开发与终端任务 (1/1)

3 个共同 benchmark 上,Grok 4.7 平均高出 9.57 分。

单项差距最大的 benchmark:Terminal-Bench 4.0 — Grok 4.7 38,Grok 4.6 20.30(分差 +17.70)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。