DeepSeek V3.2 评测详情
DeepSeek V3.2 当前已收录的代表性评测结果包括 LiveCodeBench(25 / 125,得分 83.30)、Terminal Bench Hard(70 / 244,得分 35.60)、AIME2025(32 / 110,得分 93.10)。本页还提供与 3 个前代或同系列模型的迭代对比。并附有 1 个数据来源链接供参考。
评测结果
DeepSeek V3.2
评测结果
仓库修复与多文件工程
共 3 项评测评测名称 / 模式
得分
排名/总数
自主开发与终端任务
共 3 项评测评测名称 / 模式
得分
排名/总数
历代版本对比
DeepSeek V3.2 系列各版本的评测成绩纵向对比
评测类别:
柱状图按当前筛选范围内每个模型在各评测中的最高分展示;百分制评测使用原始高度,超出 0-100 的评测按该评测内相对比例缩放,标签仍保留原始分数。
11 项可对比评测得分汇总。每个模型展示最佳得分,模式在分数下方标注。· 点击任意行可切换下方趋势图。
| 评测项 | DeepSeek V3.2当前 | DeepSeek-V3.1 | DeepSeek-V3-0324 | DeepSeek-V3 |
|---|---|---|---|---|
57.00开启思考 | -- | 9.00常规模式 | -- | |
25.10开启思考 | 15.90开启思考 | 5.20常规模式 | -- | |
2.90开启思考 | 2.00开启思考 | -- | -- | |
82.40开启思考 | 80.10开启思考 | 68.40常规模式 | 59.10常规模式 | |
73.10开启思考 | 工具 | 66.00常规模式 | 38.80常规模式 | -- | |
83.30开启思考 | 74.80开启思考 | 49.20常规模式 | 34.60常规模式 | |
93.10开启思考 | 88.40开启思考 | 47.70常规模式 | -- | |
1515.00常规模式 | 1435.90常规模式 | 1472.30常规模式 | -- | |
80.30开启思考 | 工具 | -- | 38.80常规模式 | 工具 | -- | |
35.60开启思考 | 工具 | 25.00开启思考 | 工具 | 15.20常规模式 | 工具 | 6.80常规模式 | 工具 | |
146.28思考水平·高 | 139.92思考水平·高 | -- | 132.36思考水平·高 |
单评测历史趋势图
当前查看:ARC-AGI-1 · 抽象归纳与泛化
选择评测
DeepSeek V3.2 所在系列的标准 API 价格对比
按模型并排展示标准文本输入价与输出价;若存在超长上下文加价,仅保留阈值内标准价,并在下方说明适用范围。
数据来源:DataLearnerAI,展示默认供应商的标准文本价格。 · USD / 1M tokens
| 模型 | 供应商 | 标准输入 | 标准输出 | 标准价适用于 |
|---|---|---|---|---|
DeepSeek V3.2 | DeepSeek-AI | $0.28 / 1M tokens | $0.42 / 1M tokens | — |
DeepSeek-V3.1 | Fireworks AI | $0.56 / 1M tokens | $1.68 / 1M tokens | — |
DeepSeek-V3-0324 | DeepInfra | $0.2 / 1M tokens | $0.88 / 1M tokens | — |
DeepSeek-V3 | DeepSeek-AI | $0.27 / 1M tokens | $1.1 / 1M tokens | — |