DataLearner 标志

DeepSeek-V4-ProvsQwen3.8-Max

在 6 个共同 benchmark 中,DeepSeek-V4-Pro 整体领先:DeepSeek-V4-Pro 领先 4 项,Qwen3.8-Max 领先 2 项,持平 0 项,平均分差 +1.72。

DeepSeek-AI
DeepSeek-V4-Pro

DeepSeek-AI · 2026-08-13 · 推理大模型

阿里巴巴
Qwen3.8-Max

阿里巴巴 · 2026-08-03 · 推理大模型

DeepSeek-V4-Pro4 项(67%)(33%)2 项Qwen3.8-Max

评测分数

按能力类目分组,每组内按分差大小排列;共 6 项。

跨应用与工具编排

胶着 2/2
评测项DeepSeek-V4-ProQwen3.8-Max分差
Toolathlon-Verified74.106 / 14Extra-High (With Tools)72.5013 / 14Extra-High (With Tools)+1.60
Agents' Last Exam25.7020 / 24Extra-High (With Tools)2716 / 24Extra-High (With Tools)-1.30

仓库修复与多文件工程

DeepSeek-V4-Pro 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
NL2Repo-Bench61.504 / 16Extra-High (With Tools)55.9011 / 16Extra-High (With Tools)+5.60

办公与文档流程

DeepSeek-V4-Pro 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
AutomationBench31.8019 / 25Extra-High (With Tools)27.3022 / 25Extra-High (With Tools)+4.50

自主开发与终端任务

DeepSeek-V4-Pro 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
Terminal-Bench 2.187.907 / 57Extra-High (With Tools)86.6015 / 57Extra-High (With Tools)+1.30

跨能力综合测试

Qwen3.8-Max 领先 1/1
评测项DeepSeek-V4-ProQwen3.8-Max分差
SuperCLUE70.106 / 13Reported best (effort unspecified)71.483 / 13Reported best (effort unspecified)-1.38

规格对比

字段DeepSeek-V4-ProQwen3.8-Max
发布机构DeepSeek-AI阿里巴巴
发布时间2026-08-132026-08-03
模型类型推理大模型推理大模型
架构MoE 架构MoE 架构
参数规模1.6万亿2.4万亿
上下文长度1M1M
最大输出384K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项DeepSeek-V4-ProQwen3.8-Max
文本输入$0.435 / 1M tokens¥12 / 1M tokens
文本输出$0.87 / 1M tokens¥36 / 1M tokens
缓存读取$0.003625 / 1M tokens¥1.5 / 1M tokens

小结

  • DeepSeek-V4-Pro在以下类目领先:仓库修复与多文件工程 (1/1)、办公与文档流程 (1/1)、自主开发与终端任务 (1/1)
  • Qwen3.8-Max在以下类目领先:跨能力综合测试 (1/1)
  • 胶着类目:跨应用与工具编排

6 个共同 benchmark 上,DeepSeek-V4-Pro 平均高出 1.72 分。

单项差距最大的 benchmark:NL2Repo-Bench — DeepSeek-V4-Pro 61.50,Qwen3.8-Max 55.90(分差 +5.60)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。