DataLearner 标志

Claude Opus 5vsOpus 4.7

在 19 个共同 benchmark 中,Claude Opus 5 整体领先:Claude Opus 5 领先 17 项,Opus 4.7 领先 1 项,持平 1 项,平均分差 +23.70。

Anthropic
Claude Opus 5

Anthropic · 2026-07-24 · 推理大模型

Anthropic
Opus 4.7

Anthropic · 2026-04-16 · 推理大模型

Claude Opus 517 项(89%)持平1(5%)1 项Opus 4.7

评测分数

按能力类目分组,每组内按分差大小排列;共 19 项。

临床工作与医疗决策

Claude Opus 5 领先 2/2
评测项Claude Opus 5Opus 4.7分差
MedCode63.571 / 64Max (With Tools)54.865 / 64Max (With Tools)+8.71
MedScribe90.983 / 66Max (With Tools)82.9534 / 66Max (With Tools)+8.03

客服与业务流程

胶着 2/2
评测项Claude Opus 5Opus 4.7分差
τ³-Banking48.716 / 167Max (With Tools)40.2131 / 167Max (With Tools)+8.50
SAGE49.4314 / 64Max (With Tools)56.101 / 64Max (With Tools)-6.67

抽象归纳与泛化

Claude Opus 5 领先 2/2
评测项Claude Opus 5Opus 4.7分差
ARC-AGI-330.168 / 51Thinking High (No Tools)0.1838 / 51Thinking High (No Tools)+29.98
ARC-AGI-197.5011 / 193Thinking High (No Tools)93.5047 / 193Thinking High (No Tools)+4

数学

Claude Opus 5 领先 2/2
评测项Claude Opus 5Opus 4.7分差
FrontierMath Tier 4 v273.176 / 42Max (No Tools)31.7117 / 42Max (No Tools)+41.46
FrontierMath v285.615 / 58Max (No Tools)70.1815 / 58Max (No Tools)+15.44

法律

Claude Opus 5 领先 1/2
评测项Claude Opus 5Opus 4.7分差
Legal Research Bench55.291 / 42Max (With Tools)38.4622 / 42Max (With Tools)+16.83
Harvey's Legal Agent Benchmark6.6717 / 43Max (With Tools)6.6717 / 43Max (With Tools)持平

金融

Claude Opus 5 领先 2/2
评测项Claude Opus 5Opus 4.7分差
EMB (Excel Modeling)73.564 / 42Max (With Tools)63.7320 / 42Max (With Tools)+9.83
Finance Agent v258.638 / 43Max (With Tools)51.5127 / 43Max (With Tools)+7.12

专业数据分析

Claude Opus 5 领先 1/1
评测项Claude Opus 5Opus 4.7分差
AA-AnalystAgent53.753 / 29Max (With Tools + Internet)43.7511 / 29Max (With Tools + Internet)+10

写作与创意表达

Claude Opus 5 领先 1/1
评测项Claude Opus 5Opus 4.7分差
Creative Writing2,1333 / 110Normal (No Tools)1,91412 / 110Normal (No Tools)+218.30

多轮记忆与持续上下文

Claude Opus 5 领先 1/1
评测项Claude Opus 5Opus 4.7分差
EBR-bench45.715 / 23Max (With Tools)19.0513 / 23Max (With Tools)+26.66

机器学习工程

Claude Opus 5 领先 1/1
评测项Claude Opus 5Opus 4.7分差
WeirdML v286.344 / 52Normal (With Tools)76.4013 / 52Normal (With Tools)+9.94

程序生成与编辑

Claude Opus 5 领先 1/1
评测项Claude Opus 5Opus 4.7分差
Vibe Code Bench v1.188.406 / 61Max (With Tools)7125 / 61Max (With Tools)+17.40

维护、优化与工程管理

Claude Opus 5 领先 1/1
评测项Claude Opus 5Opus 4.7分差
Code Migration57.473 / 43Max (With Tools)43.8818 / 43Max (With Tools)+13.59

跨能力聚合指数

Claude Opus 5 领先 1/1
评测项Claude Opus 5Opus 4.7分差
Vals Index67.214 / 42Max (With Tools)56.1124 / 42Max (With Tools)+11.10

规格对比

字段Claude Opus 5Opus 4.7
发布机构AnthropicAnthropic
发布时间2026-07-242026-04-16
模型类型推理大模型推理大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度1M1000K
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Claude Opus 5Opus 4.7
文本输入$5 / 1M tokens$5 / 1M tokens
文本输出$25 / 1M tokens$25 / 1M tokens
缓存读取$0.5 / 1M tokens$0.5 / 1M tokens
缓存写入$6.25 / 1M tokens$6.25 / 1M tokens

小结

  • Claude Opus 5在以下类目领先:临床工作与医疗决策 (2/2)、抽象归纳与泛化 (2/2)、数学 (2/2)、法律 (1/2)、金融 (2/2)、专业数据分析 (1/1)、写作与创意表达 (1/1)、多轮记忆与持续上下文 (1/1)、机器学习工程 (1/1)、程序生成与编辑 (1/1)、维护、优化与工程管理 (1/1)、跨能力聚合指数 (1/1)
  • 胶着类目:客服与业务流程

19 个共同 benchmark 上,Claude Opus 5 平均高出 23.70 分。

单项差距最大的 benchmark:Creative Writing — Claude Opus 5 2,133,Opus 4.7 1,914(分差 +218.30)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。