DataLearner 标志
O3

o3-pro

已弃用预计下架 · 2026-12-11推理大模型o Proo3

OpenAI o3-pro

发布时间: 2025-06-10更新于: 2026-09-18知识截止: 2024-06-01弃用: 2026-06-11预计下架: 2026-12-11浏览量: 2,543
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
200K
多语言支持
暂无数据
推理能力
5/5

o3-pro 是OpenAI于 2025-06-10 发布的推理大模型。支持文本、图像输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

o3-pro

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
200K tokens
最大输出长度
100K tokens
模型类型
推理大模型
输入/输出模态
文本、图像 → 文本
发布时间
2025-06-10
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
2024-06-01
o3-pro

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
o3-pro

官方介绍与博客

官方论文
DataLearnerAI博客
暂无
o3-pro

API接口信息

接口速度
1/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$20.00/ 1M tokens$80.00/ 1M tokens
图像-$20.00/ 1M tokens—

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

o3-pro

评测结果

o3-pro 当前已收录的代表性评测结果包括 Aider-Polyglot(3 / 59,得分 84.90)、Fiction.liveBench(1 / 16,得分 97.20)、AIME 2024(8 / 61,得分 93)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

抽象归纳与泛化

共 7 项评测
评测名称 / 模式
得分
排名/总数
ARC-AGI-1
常规模式
59.33
128 / 193
ARC-AGI-1
低工具
44.33
148 / 193
ARC-AGI-1
中工具
57
134 / 193
59.33
128 / 193
ARC-AGI-2
低工具
2.05
157 / 181
ARC-AGI-2
中工具
1.94
159 / 181
ARC-AGI-2
高工具
4.86
140 / 181

综合知识考试

共 1 项评测
评测名称 / 模式
得分
排名/总数
HLE
常规模式
21
152 / 235

科学知识与推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
84
97 / 253

仓库修复与多文件工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
75
39 / 116

数学

共 2 项评测
评测名称 / 模式
得分
排名/总数
AIME 2024
常规模式
93
8 / 61
AIME2025
常规模式
93
33 / 110

自主开发与终端任务

共 1 项评测
评测名称 / 模式
得分
排名/总数
84.90
3 / 59

跨应用与工具编排

共 1 项评测
评测名称 / 模式
得分
排名/总数
MCP-Atlas
常规模式工具
44.50
43 / 44

机器学习工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
WeirdML v2
高工具
58.21
30 / 52

跨长文理解与整合

共 1 项评测
评测名称 / 模式
得分
排名/总数
97.20
1 / 16

跨能力聚合指数

共 1 项评测
评测名称 / 模式
得分
排名/总数
ECI
unknown
147.43
57 / 167
o3-pro

发布机构

OpenAI o3-pro

模型解读

OpenAI o3-pro 模型技术概要

发布日期:2025年6月10日
可用范围:ChatGPT Pro用户及API接口

核心特性

  1. 模型定位o3-pro是基于OpenAI当前最高智能模型o3的升级版本,延续了o1-pro的设计理念,专注于深度思考能力与响应可靠性的提升。该模型尤其适用于数学、科学与编程领域的高复杂度任务,其性能已在学术评估中得到验证。
  2. 工具集成能力继承o3模型的多模态处理架构,o3-pro支持以下功能:实时网络搜索多格式文件解析视觉输入推理Python代码执行基于记忆库的个性化响应生成*注:因需调用工具链,响应速度较o1-pro有所延迟,建议在可靠性优先于即时性的场景中使用。*
  3. 性能表现在专家盲测评估中,o3-pro于科学、教育、编程、商业及写作辅助等关键领域的表现均优于o3基准模型在"4/4可靠性"严苛测试(要求模型连续四次正确解答同一问题)中,综合得分超越o1-pro与o3评测维度显示其显著优势:响应清晰度(+12%)、内容完整度(+9%)、指令遵循精度(+15%)及事实准确性(+11%)

部署计划

用户类型启用时间备注

Pro/Team用户即日生效模型选择器已替换o1-pro

Enterprise用户次周开放分批次部署

Edu用户次周开放教育机构专属通道

技术限制

  • 临时会话功能:因技术问题排查暂不可用
  • 图像生成:需切换至GPT-4o/o3/o4-mini模型实现
  • Canvas交互:当前版本尚未支持该功能模块

安全合规

o3-pro与o3共享底层架构,安全规范详见《o3系统安全白皮书》(O3 System Card)。模型优化未改变基础安全框架,原有防护机制保持生效。

o3-pro

常见问题

o3-pro 是什么模型?

o3-pro 是OpenAI于 2025-06-10 发布的推理大模型。支持文本、图像输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

o3-pro 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像输入,并生成文本输出。

o3-pro 的上下文窗口和最大输出是多少?

上下文窗口为 200K,最大输出为 100K。未公开或无法确认的规格不做推测。

o3-pro 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型相关任务;实际效果应结合具体工作流验证。

o3-pro 是否提供 API,价格如何查看?

页面已收录 OpenAI 的 3 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

o3-pro 是否开源?

代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码