DataLearner 标志
GP

GPT OSS 20B

推理大模型GPT OSSGPT OSS

GPT Opensources 20B

发布时间: 2025-08-06更新于: 2026-06-15浏览量: 1,713
在线体验GitHubHugging Face对比
模型参数
210亿
上下文长度
128K
多语言支持
支持
推理能力
3/5

GPT Opensources 20B 是由 OpenAI 发布的 AI 模型,发布时间为 2025-08-06,定位为 推理大模型,参数规模约为 210亿,上下文长度为 128K,模型文件大小约 42GB,采用 Apache 2.0 许可,在 CodeForces 上取得 2516.00 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

GPT OSS 20B

模型基本信息

推理过程
支持
思考模式
常规模式 (默认)思考模式
上下文长度
128K tokens
最大输出长度
4K tokens
模型类型
推理大模型
输入/输出模态
文本 → 文本
发布时间
2025-08-06
模型文件大小
42GB
MoE架构
是
总参数 / 激活参数
210亿 / 36亿
知识截止
暂无数据
GPT OSS 20B

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
GitHub 源码
暂无
在线体验
暂无
GPT OSS 20B

官方介绍与博客

DataLearnerAI博客
暂无
GPT OSS 20B

API接口信息

接口速度
2/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$0.070/ 1M tokens$0.300/ 1M tokens
批量模式
类型适用条件输入输出
文本-$0.035/ 1M tokens$0.150/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本-$0.070/ 1M tokens$0.040/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

GPT OSS 20B

评测结果

GPT OSS 20B 当前已收录的代表性评测结果包括 AIME 2024(3 / 61,得分 96)、AIME2025(15 / 110,得分 98.70)、MMLU(41 / 124,得分 85.30)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合知识考试

共 5 项评测
评测名称 / 模式
得分
排名/总数
MMLU
思考模式
85.30
41 / 124
73.14
92 / 175
MMLU-Pro
思考模式
74
90 / 175
HLE
思考模式
10.90
191 / 235
HLE
思考模式工具
17.30
173 / 235

科学知识与推理

共 5 项评测
评测名称 / 模式
得分
排名/总数
53.16
225 / 253
60.80
209 / 253
GPQA Diamond
思考模式
71.50
170 / 253
45.96
236 / 253
1.40
139 / 204

仓库修复与多文件工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SWE-bench Verified
思考模式
34
110 / 116

数学

共 4 项评测
评测名称 / 模式
得分
排名/总数
AIME2025
思考模式
79
68 / 110
AIME2025
思考模式工具
98.70
15 / 110
AIME2025
高工具
89.17
43 / 110
AIME 2024
思考模式工具
96
3 / 61

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
665.60
108 / 110

算法与竞赛编程

共 2 项评测
评测名称 / 模式
得分
排名/总数
CodeForces
思考模式
2230
13 / 21
CodeForces
思考模式工具
2516
10 / 21

客服与业务流程

共 2 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench
思考模式工具
47.70
37 / 44
τ³-Banking
高工具
7
144 / 167

事实查找与深度检索

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
思考模式工具
28.30
55 / 58

自主开发与终端任务

共 2 项评测
评测名称 / 模式
得分
排名/总数
4.50
214 / 244
10.60
182 / 244

跨应用与工具编排

共 2 项评测
评测名称 / 模式
得分
排名/总数
Pinch Bench
思考模式工具
66
35 / 38
36.34
42 / 45

科学计算与科研编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
38.90
113 / 134

文档与图表理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
2
110 / 122

跨能力聚合指数

共 1 项评测
评测名称 / 模式
得分
排名/总数
ECI
unknown
137.81
104 / 167
GPT OSS 20B

发布机构

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码