DataLearner 标志
DE

DeepSeek-V3

聊天大模型DeepSeek VDeepSeek V3

DeepSeek-V3

发布时间: 2024-12-26更新于: 2025-03-21浏览量: 1,634
模型参数
6810亿
上下文长度
128K
多语言支持
支持
推理能力
暂无数据

DeepSeek-V3 是由 DeepSeek-AI 发布的 AI 模型,发布时间为 2024-12-26,定位为 聊天大模型,参数规模约为 6810亿,上下文长度为 128K,模型文件大小约 687.9 GB,采用 DEEPSEEK LICENSE AGREEMENT 许可,在 ECI 上取得 132.36 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

DeepSeek-V3

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
128K tokens
最大输出长度
暂无数据
模型类型
聊天大模型
输入/输出模态
文本 → 文本
发布时间
2024-12-26
模型文件大小
687.9 GB
MoE架构
否
总参数 / 激活参数
6810亿 / 不适用
知识截止
暂无数据
DeepSeek-V3

开源和体验地址

代码开源状态
预训练权重开源
DEEPSEEK LICENSE AGREEMENT- 免费商用授权
在线体验
暂无
DeepSeek-V3

官方介绍与博客

DeepSeek-V3

API接口信息

接口速度
暂无数据
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$0.270/ 1M tokens$1.10/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本-$0.270/ 1M tokens$0.070/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

DeepSeek-V3

评测结果

DeepSeek-V3 当前已收录的代表性评测结果包括 HumanEval(9 / 101,得分 89)、MMLU(18 / 124,得分 88.50)、BBH(3 / 19,得分 92.30)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合知识考试

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
88.50
18 / 124
MMLU-Pro
常规模式
75.90
86 / 175

程序生成与编辑

共 1 项评测
评测名称 / 模式
得分
排名/总数
HumanEval
常规模式
89
9 / 101

数学

共 5 项评测
评测名称 / 模式
得分
排名/总数
MATH
常规模式
87.80
7 / 42
MATH-500
常规模式
87.80
41 / 46
AIME 2024
常规模式
39
52 / 61
4.30
21 / 24
FrontierMath
常规模式
1.70
49 / 60

综合推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
BBH
常规模式
92.30
3 / 19

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
59.10
214 / 253
GPQA
常规模式
59.10
8 / 17

事实可靠性与幻觉

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleQA
常规模式
24.90
31 / 46

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
常规模式
34.60
112 / 125

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleBench
常规模式
18.90
92 / 96

自主开发与终端任务

共 2 项评测
评测名称 / 模式
得分
排名/总数
Aider-Polyglot
常规模式
48.40
34 / 59
Terminal Bench Hard
常规模式工具
6.80
194 / 244

科学计算与科研编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SciCode
常规模式
35.80
121 / 134

客服与业务流程

共 1 项评测
评测名称 / 模式
得分
排名/总数
τ³-Banking
常规模式工具
4.70
159 / 167

文档与图表理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
GDP.pdf
常规模式
0.80
119 / 122

跨能力聚合指数

共 1 项评测
评测名称 / 模式
得分
排名/总数
ECI
unknown
132.36
112 / 167
DeepSeek-V3

发布机构

DeepSeek-V3

模型解读

DeepSeek AI开源的大语言模型,是其开源的第三代大语言模型。DeepSeek V3是一个混合专家架构的模型(Mixture-of-Experts),总参数量6810亿,每次推理会激活其中370亿的参数。DeepSeek V3模型在14.8万亿tokens上完成训练,花费了278.8万个H800小时训练完成,其各项评测结果都十分优异。

本版本是经过后训练(Post Training)之后的版本。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码