DataLearner 标志
OP

OpenAI o3-mini

已弃用预计下架 · 2026-10-23推理大模型o Minio3

OpenAI o3-mini

发布时间: 2025-01-31更新于: 2026-09-18弃用: 2026-04-22预计下架: 2026-10-23浏览量: 559
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
200K
多语言支持
支持
推理能力
4/5

OpenAI o3-mini 是由 OpenAI 发布的 AI 模型,发布时间为 2025-01-31,定位为 推理大模型,上下文长度为 200K,采用 不开源 许可,在 CodeForces 上取得 2073.00 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

OpenAI o3-mini

模型基本信息

推理过程
支持
思考模式
思考水平 · 深度 (Deep)
上下文长度
200K tokens
最大输出长度
100K tokens
模型类型
推理大模型
输入/输出模态
文本 → 文本
发布时间
2025-01-31
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
暂无数据
OpenAI o3-mini

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
OpenAI o3-mini

官方介绍与博客

官方论文
DataLearnerAI博客
暂无
OpenAI o3-mini

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$1.10/ 1M tokens$4.40/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本-—$0.550/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

OpenAI o3-mini

评测结果

OpenAI o3-mini 当前已收录的代表性评测结果包括 MMLU(43 / 124,得分 84.90)、Aider-Polyglot(21 / 59,得分 60.40)、AIME2025(53 / 110,得分 86.50)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合知识考试

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMLU
思考模式
84.90
43 / 124
HLE
思考模式
13.40
184 / 235

抽象归纳与泛化

共 6 项评测
评测名称 / 模式
得分
排名/总数
14.50
180 / 193
22.33
171 / 193
34.50
160 / 193
0
176 / 181
2.08
156 / 181
3
152 / 181

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
思考模式
70.60
179 / 253
0.30
186 / 204

仓库修复与多文件工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SWE-bench Verified
思考模式
40.80
106 / 116

数学

共 6 项评测
评测名称 / 模式
得分
排名/总数
MATH-500
思考模式
95.80
25 / 46
AIME2025
思考模式
86.50
53 / 110
AIME 2024
思考模式
60
42 / 61
18.60
52 / 58
4.20
40 / 80

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
CodeForces
思考模式
2073
15 / 21

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
22.80
87 / 96

自主开发与终端任务

共 4 项评测
评测名称 / 模式
得分
排名/总数
53.80
29 / 59
60.40
21 / 59
Terminal Bench Hard
思考模式工具
6.80
194 / 244
6.10
204 / 244

科学计算与科研编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
42.80
100 / 134

客服与业务流程

共 1 项评测
评测名称 / 模式
得分
排名/总数
τ³-Banking
高工具
5.20
157 / 167

文档与图表理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
2
110 / 122

跨能力聚合指数

共 1 项评测
评测名称 / 模式
得分
排名/总数
ECI
unknown
140.35
93 / 167
OpenAI o3-mini

发布机构

OpenAI o3-mini

模型解读

OpenAI o3 mini是OpenAI发布的一个OpenAI o3模型的较小参数规模版本,速度更快。 OpenAI o3 mini是OpenAI发布的第二代推理大模型中最小规模的版本。第一代推理大模型是o1,跳过了o2版本号的原因可能是o2与英国电信运营商的品牌冲突。o3 mini总共分为三个版本,o3-mini low,o3-mini medium 和o3-mini high。本模型为其中最强的版本,即o3-mini high。ChatGPT中免费用户使用的是o3-mini meidum版本。Plus用户可以选择这个版本。同时,根据测试,这个版本的模型也比之前的o1更强。 不同版本的评测结果如下: | Category | 01-mini | 03-mini (low) | 03-mini (medium) | 03-mini (high) | | --- | --- | --- | --- | --- | | General | 85.2 | 84.9 | 85.9 | 86.9 | | Math | 90.0 | 95.8 | 97.3 | 97.9 | | Factuality | 89.9 | 55.1 | 90.8 | 92.0 | | Eval | 76.0 | 13.0 | 13.4 | 13.8 |

ModelReasoning LevelAverageLCB GenerationCode Completion
o3-minilow0.6180.7560.48
o3-minimedium0.7230.8460.60
o3-minihigh0.8460.8200.833
o1-minihigh0.6740.6280.72

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码