DataLearner 标志

Grok 4.5vsGPT-5.6 Sol

在 4 个共同 benchmark 中,GPT-5.6 Sol 整体领先:Grok 4.5 领先 0 项,GPT-5.6 Sol 领先 4 项,持平 0 项,平均分差 -103.39。

xAI
Grok 4.5

xAI · 2026-07-08 · 编程大模型

OpenAI
GPT-5.6 Sol

OpenAI · 2026-06-26 · 推理大模型

Grok 4.50 项(0%)(100%)4 项GPT-5.6 Sol

评测分数

按能力类目分组,每组内按分差大小排列;共 4 项。

写作与创意表达

GPT-5.6 Sol 领先 1/1
评测项Grok 4.5GPT-5.6 Sol分差
Creative Writing1,57945 / 110Normal (No Tools)1,9729 / 110Normal (No Tools)-392.80

文档与图表理解

GPT-5.6 Sol 领先 1/1
评测项Grok 4.5GPT-5.6 Sol分差
GDP.pdf18.8044 / 122Thinking High (No Tools)27.808 / 122Thinking High (No Tools)-9

科学计算与科研编程

GPT-5.6 Sol 领先 1/1
评测项Grok 4.5GPT-5.6 Sol分差
SciCode5539 / 134Thinking High (No Tools)57.8016 / 134Thinking High (No Tools)-2.80

跨应用与工具编排

GPT-5.6 Sol 领先 1/1
评测项Grok 4.5GPT-5.6 Sol分差
PinchBench v275.2119 / 45Reported best (effort unspecified)84.197 / 45Reported best (effort unspecified)-8.98

规格对比

字段Grok 4.5GPT-5.6 Sol
发布机构xAIOpenAI
发布时间2026-07-082026-06-26
模型类型编程大模型推理大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度500K1.05M
最大输出暂无数据128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Grok 4.5GPT-5.6 Sol
文本输入$2 / 1M tokens$4 / 1M tokens
文本输出$6 / 1M tokens$20 / 1M tokens
缓存读取$0.5 / 1M tokens$0.4 / 1M tokens
缓存写入暂无公开价格$5 / 1M tokens

小结

  • GPT-5.6 Sol在以下类目领先:写作与创意表达 (1/1)、文档与图表理解 (1/1)、科学计算与科研编程 (1/1)、跨应用与工具编排 (1/1)

4 个共同 benchmark 上,GPT-5.6 Sol 平均高出 103.39 分。

单项差距最大的 benchmark:Creative Writing — Grok 4.5 1,579,GPT-5.6 Sol 1,972(分差 -392.80)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。