DataLearner 标志
KI

Kimi K3

推理大模型编程大模型Kimi K3

Kimi K3

发布时间: 2026-07-16更新于: 2026-07-28 08:43:42.4307,642
模型参数
2.8万亿
上下文长度
1M
中文支持
支持
推理能力

Kimi K3 是 Moonshot AI 的开放权重 2.8T MoE 多模态旗舰模型,每 token 激活约 104B 参数,支持 1M 上下文和 low/high/max 思考档;代码、96 个权重分片与技术报告已按 Kimi K3 License 开放。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Kimi K3

模型基本信息

推理过程
支持
思考模式
思考水平 · 最高 (Max) (默认)思考水平 · 低 (Low)思考水平 · 高 (High)
上下文长度
1M tokens
最大输出长度
1M tokens
模型类型
推理大模型
输入/输出模态
文本、图像、视频 → 文本
发布时间
2026-07-16
模型文件大小
约 1.42 TiB(MXFP4,96 个 Safetensors 分片)
MoE架构
总参数 / 激活参数
2.8万亿 / 1040亿
知识截止
暂无数据
Kimi K3

开源和体验地址

代码开源状态
预训练权重开源
Kimi K3 License- 有条件免费商用授权
Kimi K3

官方介绍与博客

DataLearnerAI博客
暂无介绍博客
Kimi K3

API接口信息

接口速度
2/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-¥20.00/ 1M¥100.00/ 1M
international
类型适用条件输入输出
文本-$3.00/ 1M$15.00/ 1M
缓存定价Prompt缓存
类型有效期写入读取
文本--$0.300/ 1M
Kimi K3

评测结果

Kimi K3 当前已收录的代表性评测结果包括 BrowseComp(1 / 53,得分 91.20)、GPQA Diamond(8 / 187,得分 93.50)、AA-LCR(1 / 15,得分 74.70)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合评估

共 4 项评测
评测名称 / 模式
得分
排名/总数
93.50
8 / 187
HLE
最高
43.50
47 / 172
HLE
最高工具
56
12 / 172
CritPt
最高
23.40
1 / 1

AI Agent - 信息收集

共 2 项评测
评测名称 / 模式
得分
排名/总数
DeepSearchQA
最高工具联网
95
1 / 1
BrowseComp
最高工具联网
91.20
1 / 53

长上下文能力

共 1 项评测
评测名称 / 模式
得分
排名/总数
AA-LCR
最高
74.70
1 / 15

AI Agent - 工具使用

共 8 项评测
评测名称 / 模式
得分
排名/总数
MCPMark-Verified
最高工具
94.50
1 / 1
TerminalBench 2.1
最高工具
88.30
2 / 28
OSWorld-Verified
最高工具
84.80
2 / 24
MCP-Atlas
最高工具
84.20
2 / 27
76.50
1 / 2
SaaS-Bench
最高工具
60.10
1 / 1
OSWorld 2.0
最高工具
58.30
3 / 3
Automation Bench
最高工具
30.80
1 / 3

编程与软件工程

共 8 项评测
评测名称 / 模式
得分
排名/总数
FrontierSWE
最高工具
81.20
1 / 1
Program Bench
最高工具
77.80
1 / 1
72.90
1 / 1
DeepSWE
最高工具
67.50
5 / 20
SciCode
最高工具
58.70
1 / 1
MLS Bench
最高工具
48.30
1 / 1
SWE-Marathon
最高工具
42
1 / 2
PostTrain Bench
最高工具
36.60
1 / 1

Agent能力评测

共 4 项评测
评测名称 / 模式
得分
排名/总数
Job Bench
最高工具
54.30
1 / 1
APEX-Agents
最高工具
41
1 / 1
τ³-Banking
最高工具
33.40
1 / 1
Agents' Last Exam
最高工具
28.30
4 / 5

生产力知识

共 9 项评测
评测名称 / 模式
得分
排名/总数
GDPval-AA v2
最高工具
1686
2 / 5
AA-Briefcase
最高工具
1548
2 / 2
Harvey Lab-AA
最高工具
94.60
1 / 1
ResearchRubrics
最高工具联网
76.20
1 / 1
CorpFin v2
最高工具
71.60
1 / 1
Office QA Pro
最高工具
63.30
1 / 1
Finance Agent v2
最高工具
54.40
1 / 1
44.20
1 / 1
SpreadsheetBench 2
最高工具
34.80
1 / 1

多模态理解

共 14 项评测
评测名称 / 模式
得分
排名/总数
94.30
3 / 4
MathVision
最高工具
97.80
1 / 4
84.80
5 / 8
CharXiv RQ
最高工具
91.30
1 / 8
91.10
1 / 1
90
1 / 1
BabyVision
最高工具
85.70
1 / 2
MMMU-Pro
最高
81.60
3 / 6
MMMU-Pro
最高工具
83.40
1 / 6
MMVU
最高
82.10
1 / 1
58.50
1 / 1
23
2 / 2
ZeroBench Main
最高工具
41
1 / 2

和其他模型对比

Kimi K3

发布机构

Kimi K3

模型解读

Kimi K3 与开放权重

Kimi K3 是 Moonshot AI 于 2026 年 7 月 16 日发布的原生多模态智能体旗舰模型。官方称其为首个开放的 3T 级模型:总参数量 2.8T、每 token 激活约 104B 参数,支持 1,048,576 tokens 上下文。完整模型权重、推理代码与技术报告已于北京时间 2026 年 7 月 28 日开放,可从 Hugging Face 和 GitHub 获取。

架构与技术规格

K3 采用 Stable LatentMoE:共 93 层,其中 1 个稠密层;注意力层由 69 层 Kimi Delta Attention(KDA)和 24 层 Gated MLA 组成。模型拥有 896 个路由专家,每个 token 选择 16 个专家,另有 2 个共享专家;隐藏维度为 7168,96 个注意力头,词表规模约 160K。视觉编码器为 401M 参数的 MoonViT-V2。

模型从 SFT 阶段开始采用量化感知训练,发布权重为 MXFP4,激活为 MXFP8。Hugging Face 仓库包含 96 个 Safetensors 分片,权重及相关大文件约 1.42 TiB。官方推荐 vLLM、SGLang 与 TokenSpeed 作为推理引擎。

能力与 API

K3 面向长周期软件工程、知识工作、深度推理和视觉任务,支持文本、图像和视频输入以及文本输出。API 支持函数与工具调用、严格 JSON Schema 结构化输出、Partial Mode、动态工具加载、自动上下文缓存,以及 OpenAI/Anthropic 兼容调用方式。

K3 始终启用思考,reasoning_effort 支持 low、high、max 三档,默认 max。多轮对话和工具调用必须原样回传上一轮完整 assistant message,包括 reasoning_contenttool_calls

官方评测

本页按开放权重模型卡同步官方最新评测表,共 45 个基准、50 条结构化成绩(含 5 组无工具/工具增强双结果)。所有 K3 成绩均使用 max reasoning effort 与 temperature=1.0;单步推理和无工具视觉任务采用 top_p=0.95,智能体任务采用 top_p=1.0。代表性结果包括 GPQA Diamond 93.5、DeepSWE 67.5、Terminal-Bench 2.1 88.3、BrowseComp 91.2、MCPMark-Verified 94.5、OSWorld-Verified 84.8、OmniDocBench 91.1。

价格与访问条件

官方 API 按每百万 tokens 计费:中国区缓存命中输入 ¥2、缓存未命中输入 ¥20、输出 ¥100;国际区分别为 $0.30、$3、$15。K3 API 需账户成功充值至少 1 美元后解锁,账户等级决定并发和速率限制。

Kimi K3 License

代码、权重、配置与相关文档均采用 Kimi K3 License。该许可允许使用、复制、修改、分发、再许可、销售、部署和微调,但须保留版权与许可声明并遵守适用法律。若许可方或关联方经营 MaaS 且任意连续 12 个月总收入超过 2,000 万美元,商业使用前须与 Moonshot AI 另签协议;若商业产品月活超过 1 亿或月收入超过 2,000 万美元,界面须显著展示“Kimi K3”。内部使用、官方产品和认证推理合作伙伴适用例外条款。

使用限制

  • API 的 temperature=1.0、top_p=0.95、n=1、presence_penalty=0 和 frequency_penalty=0 为固定值。
  • 视觉输入不支持直接使用公网图片 URL,应使用 base64 或已上传文件的 ms:// 地址。
  • 官方 Web Search 正在更新,当前不建议用于生产工作流。
  • 自部署需要极高的存储、显存、互联和推理引擎适配成本,开放权重不等于普通工作站可运行。

官方资料

Hugging Face 权重与模型卡 · GitHub 代码与技术报告 · 官方技术博客 · API 快速开始 · 官方价格

Kimi K3

常见问题

Kimi K3 已经开放权重了吗?

是。完整模型权重、推理代码和技术报告已于北京时间 2026 年 7 月 28 日开放;官方 Hugging Face 仓库提供 96 个 Safetensors 权重分片,相关大文件约 1.42 TiB。

Kimi K3 的参数和架构是什么?

总参数量 2.8T、每 token 激活约 104B;共 93 层,包含 69 层 KDA 与 24 层 Gated MLA,896 个路由专家中每 token 选择 16 个,另有 2 个共享专家。

Kimi K3 可以免费商用吗?

Kimi K3 License 允许商业使用,但附带条件:年收入超过 2,000 万美元的 MaaS 业务须另签协议;达到 1 亿月活或 2,000 万美元月收入的商业产品须显著展示“Kimi K3”。使用前应阅读完整许可。

Kimi K3 支持哪些思考档和输入?

K3 始终启用思考,支持 low、high、max 三档,默认 max;API 支持文本、图像和视频输入,输出文本,并支持工具调用和结构化输出。

Kimi K3 API 如何计费?

每百万 tokens:中国区缓存命中输入 ¥2、缓存未命中输入 ¥20、输出 ¥100;国际区分别为 $0.30、$3、$15。账户至少充值 1 美元后解锁 K3。

Kimi K3 公布了哪些评测?

开放权重模型卡列出 45 个基准、50 条结构化结果。代表性成绩包括 GPQA Diamond 93.5、DeepSWE 67.5、BrowseComp 91.2、MCPMark-Verified 94.5、OSWorld-Verified 84.8 和 OmniDocBench 91.1。

自部署 Kimi K3 需要注意什么?

官方推荐 vLLM、SGLang 或 TokenSpeed;MXFP4 权重及相关大文件约 1.42 TiB,自部署仍需要大规模加速器内存、高速互联、存储与匹配的推理引擎。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码