OpenAI o3-mini
OpenAI o3-mini 是由 OpenAI 发布的 AI 模型,发布时间为 2025-01-31,定位为 推理大模型,上下文长度为 200K,采用 不开源 许可,在 CodeForces 上取得 2073.00 分。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
模型基本信息
开源和体验地址
官方介绍与博客
API接口信息
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $1.10/ 1M tokens | $4.40/ 1M tokens |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | - | — | $0.550/ 1M tokens |
表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。
评测结果
OpenAI o3-mini 当前已收录的代表性评测结果包括 MMLU(43 / 124,得分 84.90)、Aider-Polyglot(21 / 59,得分 60.40)、AIME2025(53 / 110,得分 86.50)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
抽象归纳与泛化
共 6 项评测数学
共 6 项评测自主开发与终端任务
共 4 项评测发布机构
模型解读
OpenAI o3 mini是OpenAI发布的一个OpenAI o3模型的较小参数规模版本,速度更快。 OpenAI o3 mini是OpenAI发布的第二代推理大模型中最小规模的版本。第一代推理大模型是o1,跳过了o2版本号的原因可能是o2与英国电信运营商的品牌冲突。o3 mini总共分为三个版本,o3-mini low,o3-mini medium 和o3-mini high。本模型为其中最强的版本,即o3-mini high。ChatGPT中免费用户使用的是o3-mini meidum版本。Plus用户可以选择这个版本。同时,根据测试,这个版本的模型也比之前的o1更强。 不同版本的评测结果如下: | Category | 01-mini | 03-mini (low) | 03-mini (medium) | 03-mini (high) | | --- | --- | --- | --- | --- | | General | 85.2 | 84.9 | 85.9 | 86.9 | | Math | 90.0 | 95.8 | 97.3 | 97.9 | | Factuality | 89.9 | 55.1 | 90.8 | 92.0 | | Eval | 76.0 | 13.0 | 13.4 | 13.8 |
| Model | Reasoning Level | Average | LCB Generation | Code Completion |
|---|---|---|---|---|
| o3-mini | low | 0.618 | 0.756 | 0.48 |
| o3-mini | medium | 0.723 | 0.846 | 0.60 |
| o3-mini | high | 0.846 | 0.820 | 0.833 |
| o1-mini | high | 0.674 | 0.628 | 0.72 |
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
