DataLearner 标志
KI

Kimi K2

已下架 · 2026-05-25聊天大模型KimiKimi K2

Kimi-K2-0711-Preview

发布时间: 2025-07-11更新于: 2026-09-18退役: 2026-05-25浏览量: 2,963
模型参数
1万亿
上下文长度
131K
多语言支持
支持
推理能力
3/5

Kimi-K2-0711-Preview 是由 Moonshot AI 发布的 AI 模型,发布时间为 2025-07-11,定位为 聊天大模型,参数规模约为 1万亿,上下文长度为 131K,模型文件大小约 1.01TB,采用 Modified MIT 许可,在 Creative Writing 上取得 1665.70 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Kimi K2

模型基本信息

推理过程
暂无数据
思考模式
常规模式 (默认)思考模式
上下文长度
131K tokens
最大输出长度
131K tokens
模型类型
聊天大模型
输入/输出模态
文本 → 文本
发布时间
2025-07-11
模型文件大小
1.01TB
MoE架构
是
总参数 / 激活参数
1万亿 / 320亿
知识截止
暂无数据
Kimi K2

开源和体验地址

代码开源状态
预训练权重开源
Modified MIT- 免费商用授权
在线体验
Kimi K2

官方介绍与博客

Kimi K2

API接口信息

接口速度
2/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$0.600/ 1M tokens$2.50/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Kimi K2

评测结果

Kimi K2 当前已收录的代表性评测结果包括 MMLU(13 / 124,得分 89.50)、MATH-500(12 / 46,得分 97.40)、Creative Writing(36 / 110,得分 1665.70)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合知识考试

共 3 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
89.50
13 / 124
MMLU-Pro
常规模式
81.10
58 / 175
HLE
常规模式
4.70
228 / 235

抽象归纳与泛化

共 1 项评测
评测名称 / 模式
得分
排名/总数
ARC-AGI-1
常规模式
13.30
182 / 193

科学知识与推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
75.10
157 / 253

事实可靠性与幻觉

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleQA
常规模式
31
23 / 46

仓库修复与多文件工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SWE-bench Verified
常规模式
51.80
94 / 116

数学

共 6 项评测
评测名称 / 模式
得分
排名/总数
MATH-500
常规模式
97.40
12 / 46
AIME 2024
常规模式
69.60
39 / 61
AIME2025
常规模式
54
94 / 110
7.10
16 / 24
FrontierMath
常规模式
2.10
47 / 60
0.01
71 / 80

算法与竞赛编程

共 3 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
常规模式
53.70
90 / 125
IOI 2025 (Vals v1)
常规模式工具
2
7 / 9
IOI 2024 (Vals v1)
常规模式工具
0.50
10 / 10

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
1665.70
36 / 110

自主开发与终端任务

共 3 项评测
评测名称 / 模式
得分
排名/总数
Aider-Polyglot
常规模式
59.10
24 / 59
Terminal-Bench
常规模式
37.50
15 / 35
Terminal Bench Hard
常规模式工具
15.90
165 / 244

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleBench
常规模式
26.30
83 / 96

客服与业务流程

共 3 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench - Telecom
思考模式工具
65.80
24 / 30
τ²-Bench
常规模式工具
64.30
29 / 44
τ²-Bench
思考模式工具
64.30
29 / 44

跨能力综合测试

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveBench
常规模式
48.10
102 / 117
Kimi K2

模型变体及不同版本下载

变体名称版本类型量化类型模型大小HuggingFace 地址
Kimi-K2-Instructℹ️InstructBF161031.15 GB下载地址
Kimi-K2-Baseℹ️BaseBF161031.15 GB下载地址
Kimi K2

发布机构

Kimi-K2-0711-Preview

模型解读

Kimi K2是月之暗面发布的一个混合专家架构的推理大模型,参数量1万亿,每次推理激活320亿参数。这也是业界第一个宣称达到万亿参数的商用大模型。2025年7月11日,官方还未发布的时候就在开发者网站上上线了该模型信息,主要特点如下:

  • kimi-k2 是一款具备超强代码和 Agent 能力的 MoE 架构基础模型,总参数 1T,激活参数 32B。在通用知识推理、编程、数学、Agent 等主要类别的基准性能测试中,K2 模型的性能超过其他主流开源模型
  • kimi-k2 模型上下文长度为 128k
  • 不支持视觉功能
  • 支持 ToolCalls、JSON Mode、Partial Mode、联网搜索功能等

本模型的开源协议是一个修改版本的MIT协议,虽然也可以无条件免费商用,但是有一条额外的义务内容:

  1. 触发门槛:软件或其衍生作品被用于「月活 >1 亿」或「月收入 >2 000 万美元」的商业产品/服务。
  2. 义务内容:必须在其用户界面上「显著展示『Kimi K2』」。

本模型包含2个版本,分别是Base版本和指令优化版本。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码