DataLearner 标志

GPT-5vsGemini 2.5-Pro

在 8 个共同 benchmark 中,GPT-5 整体领先:GPT-5 领先 7 项,Gemini 2.5-Pro 领先 1 项,持平 0 项,平均分差 +63.49。

OpenAI
GPT-5

OpenAI · 2025-08-07 · 基础大模型

Google DeepMind
Gemini 2.5-Pro

Google DeepMind · 2025-06-05 · 推理大模型

GPT-57 项(88%)(13%)1 项Gemini 2.5-Pro

评测分数

按能力类目分组,每组内按分差大小排列;共 8 项。

算法与竞赛编程

GPT-5 领先 2/3
评测项GPT-5Gemini 2.5-Pro分差
CodeClash1,3602 / 8Normal (With Tools)1,1256 / 8Normal (With Tools)+235
IOI 2025 (Vals v1)292 / 9Thinking (With Tools)15.203 / 9Thinking (With Tools)+13.80
IOI 2024 (Vals v1)114 / 10Thinking (With Tools)192 / 10Thinking (With Tools)-8

数学

GPT-5 领先 2/2
评测项GPT-5Gemini 2.5-Pro分差
IMO-ProofBench592 / 16Thinking (No Tools)55.203 / 16Thinking (No Tools)+3.80
IMO-ProofBench Advanced2011 / 24Thinking (No Tools)17.6014 / 24Thinking (No Tools)+2.40

事实查找与深度检索

GPT-5 领先 1/1
评测项GPT-5Gemini 2.5-Pro分差
BrowseComp54.9042 / 58Thinking (With Tools)7.8057 / 58Thinking (With Tools)+47.10

写作与创意表达

GPT-5 领先 1/1
评测项GPT-5Gemini 2.5-Pro分差
Creative Writing1,62739 / 110Normal (No Tools)1,42162 / 110Normal (No Tools)+205.40

客服与业务流程

GPT-5 领先 1/1
评测项GPT-5Gemini 2.5-Pro分差
τ³-Banking22.1086 / 167Thinking High (With Tools)13.66117 / 167Thinking High (With Tools)+8.44

规格对比

字段GPT-5Gemini 2.5-Pro
发布机构OpenAIGoogle DeepMind
发布时间2025-08-072025-06-05
模型类型基础大模型推理大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度400K1000K
最大输出128K64K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GPT-5Gemini 2.5-Pro
文本输入$1.25 / 1M tokens$1.25 / 1M tokens
文本输出$10 / 1M tokens$10 / 1M tokens
缓存读取$0.125 / 1M tokens$0.125 / 1M tokens
缓存写入$0 / 1M tokens暂无公开价格

小结

  • GPT-5在以下类目领先:算法与竞赛编程 (2/3)、数学 (2/2)、事实查找与深度检索 (1/1)、写作与创意表达 (1/1)、客服与业务流程 (1/1)

8 个共同 benchmark 上,GPT-5 平均高出 63.49 分。

单项差距最大的 benchmark:CodeClash — GPT-5 1,360,Gemini 2.5-Pro 1,125(分差 +235)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。