DataLearner 标志

GPT-5vsClaude Opus 4

GPT-5 与 Claude Opus 4 在 8 个共同 benchmark 中整体接近:GPT-5 领先 4 项,Claude Opus 4 领先 4 项,持平 0 项,平均分差 +9.77。

OpenAI
GPT-5

OpenAI · 2025-08-07 · 基础大模型

Anthropic
Claude Opus 4

Anthropic · 2025-05-23 · 推理大模型

GPT-54 项(50%)(50%)4 项Claude Opus 4

评测分数

按能力类目分组,每组内按分差大小排列;共 8 项。

数学

GPT-5 领先 2/3
评测项GPT-5Claude Opus 4分差
IMO-ProofBench592 / 16Thinking (No Tools)2.9016 / 16Thinking (No Tools)+56.10
IMO-ProofBench Advanced2011 / 24Thinking (No Tools)2.9024 / 24Thinking (No Tools)+17.10
AIME202561.9089 / 110Normal (No Tools)75.5074 / 110Normal (No Tools)-13.60

写作与创意表达

GPT-5 领先 1/1
评测项GPT-5Claude Opus 4分差
Creative Writing1,62739 / 110Normal (No Tools)1,58044 / 110Normal (No Tools)+46.90

客服与业务流程

GPT-5 领先 1/1
评测项GPT-5Claude Opus 4分差
τ²-Bench8015 / 44Thinking (With Tools)72.5024 / 44Thinking (With Tools)+7.50

抽象归纳与泛化

Claude Opus 4 领先 1/1
评测项GPT-5Claude Opus 4分差
ARC-AGI-16188 / 193Normal (No Tools)35.67159 / 193Normal (No Tools)-29.67

科学知识与推理

Claude Opus 4 领先 1/1
评测项GPT-5Claude Opus 4分差
GPQA Diamond77.80143 / 253Normal (No Tools)79.60135 / 253Normal (No Tools)-1.80

综合知识考试

Claude Opus 4 领先 1/1
评测项GPT-5Claude Opus 4分差
HLE6.30217 / 235Normal (No Tools)10.70193 / 235Normal (No Tools)-4.40

规格对比

字段GPT-5Claude Opus 4
发布机构OpenAIAnthropic
发布时间2025-08-072025-05-23
模型类型基础大模型推理大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度400K200K
最大输出128K32K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项GPT-5Claude Opus 4
文本输入$1.25 / 1M tokens$15 / 1M tokens
文本输出$10 / 1M tokens$75 / 1M tokens
缓存读取$0.125 / 1M tokens$1.5 / 1M tokens
缓存写入$0 / 1M tokens$18.75 / 1M tokens

小结

  • GPT-5在以下类目领先:数学 (2/3)、写作与创意表达 (1/1)、客服与业务流程 (1/1)
  • Claude Opus 4在以下类目领先:抽象归纳与泛化 (1/1)、科学知识与推理 (1/1)、综合知识考试 (1/1)

8 个共同 benchmark 上,GPT-5 平均高出 9.77 分。

单项差距最大的 benchmark:IMO-ProofBench — GPT-5 59,Claude Opus 4 2.90(分差 +56.10)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。