DataLearner 标志
GP

GPT-6 Astra

预览版推理大模型编程大模型AstraGPT-6

OpenAI GPT-6 Astra

别名:GPT-6 / GPT Astra / OpenAI Astra / Astra

发布时间: 2026-09-03更新于: 2026-09-04知识截止: 2026-04-30浏览量: 3,958
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
1.05M
多语言支持
支持
推理能力
5/5

OpenAI 于 2026 年 9 月 3 日发布 GPT-6 Astra,定位为面向复杂推理、编程、计算机操作、研究与文档工作的旗舰模型。官方 API 标识为 gpt-6-astra,支持 105 万 token 上下文、12.8 万 token 最大输出、文本与图像输入,以及 low、medium、high、xhigh、max 五档推理强度。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

GPT-6 Astra

模型基本信息

推理过程
支持
思考模式
思考水平 · 中 (Medium) (默认)思考水平 · 低 (Low)思考水平 · 高 (High)思考水平 · 极高 (Extra-High)思考水平 · 最高 (Max)
上下文长度
1.05M tokens
最大输出长度
128K tokens
模型类型
推理大模型
输入/输出模态
文本、图像 → 文本
发布时间
2026-09-03
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
2026-04-30
GPT-6 Astra

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
GPT-6 Astra

官方介绍与博客

DataLearnerAI博客
暂无
GPT-6 Astra

API接口信息

接口速度
4/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本上下文长度 <= 272000$10.00/ 1M tokens$50.00/ 1M tokens
文本上下文长度 > 272000$20.00/ 1M tokens$75.00/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本-$12.50/ 1M tokens
上下文长度 <= 272000
$1.00/ 1M tokens
上下文长度 <= 272000
文本-$25.00/ 1M tokens
上下文长度 > 272000
$2.00/ 1M tokens
上下文长度 > 272000

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

GPT-6 Astra

评测结果

GPT-6 Astra 当前已收录的代表性评测结果包括 MMMU-Pro(1 / 229,得分 86.90)、ARC-AGI-1(1 / 193,得分 98.50)、ARC-AGI-2(1 / 181,得分 95)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

抽象归纳与泛化

共 26 项评测
评测名称 / 模式
得分
排名/总数
96.72
6 / 26
35.18
7 / 51
17.45
10 / 51
38.59
6 / 51
54.82
3 / 51
62.71
1 / 51
59.34
2 / 51
ARC-AGI-1
常规模式
86
90 / 193
ARC-AGI-1
低工具
96.50
24 / 193
ARC-AGI-1
中工具
97.50
11 / 193
ARC-AGI-1
高工具
98.50
1 / 193
ARC-AGI-1
最高
97.50
11 / 193
ARC-AGI-1
最高工具
97.50
11 / 193
ARC-AGI-1
极高
98.50
1 / 193
ARC-AGI-1
极高工具
98.50
1 / 193
ARC-AGI-2
常规模式
59.58
77 / 181
ARC-AGI-2
低工具
85.42
27 / 181
ARC-AGI-2
中工具
92.08
7 / 181
ARC-AGI-2
高工具
92.08
7 / 181
ARC-AGI-2
最高
95
1 / 181
ARC-AGI-2
极高工具
93.33
3 / 181

综合知识考试

共 2 项评测
评测名称 / 模式
得分
排名/总数
HLE
unknown
54.80
25 / 235
HLE
最高工具
57.20
17 / 235

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
2173.30
1 / 110

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
83.60
4 / 96

事实查找与深度检索

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
最高工具
91.50
1 / 58

自主开发与终端任务

共 10 项评测
评测名称 / 模式
得分
排名/总数
86.74
13 / 57
86.97
12 / 57
87.42
10 / 57
Terminal-Bench 2.1
最高工具
86.74
13 / 57
Terminal-Bench 2.1
极高工具
85.84
16 / 57

仓库修复与多文件工程

共 7 项评测
评测名称 / 模式
得分
排名/总数
96.90
4 / 10
90.20
3 / 11
DeepSWE
低工具
67.04
35 / 92
DeepSWE
中工具
72.79
12 / 92
DeepSWE
高工具
73.23
9 / 92
DeepSWE
最高工具
74.10
5 / 92
DeepSWE
极高工具
74.12
4 / 92

桌面工作流

共 1 项评测
评测名称 / 模式
得分
排名/总数
OSWorld 2.0
最高工具
72.60
3 / 14

跨应用与工具编排

共 1 项评测
评测名称 / 模式
得分
排名/总数
Agents' Last Exam
最高工具
59.30
1 / 24

办公与文档流程

共 1 项评测
评测名称 / 模式
得分
排名/总数
AutomationBench
最高工具
41.40
14 / 25

图像感知与视觉推理

共 5 项评测
评测名称 / 模式
得分
排名/总数
84.60
10 / 229
85.10
6 / 229
86.40
2 / 229
MMMU-Pro
最高
86.90
1 / 229
MMMU-Pro
极高
86.20
3 / 229

科学知识与推理

共 6 项评测
评测名称 / 模式
得分
排名/总数
MysteryMechanism
最高工具
53.15
1 / 13
26.30
24 / 204
29.10
12 / 204
28.90
15 / 204
CritPt
最高
31.70
3 / 204
CritPt
极高
31.40
4 / 204

科学计算与科研编程

共 6 项评测
评测名称 / 模式
得分
排名/总数
68.10
1 / 18
54.10
48 / 134
54.20
47 / 134
55.40
36 / 134
SciCode
最高
56.50
25 / 134
SciCode
极高
55.70
33 / 134

客服与业务流程

共 6 项评测
评测名称 / 模式
得分
排名/总数
SAGE
最高工具
46.37
28 / 64
τ³-Banking
低工具
32
56 / 167
τ³-Banking
中工具
35.50
46 / 167
τ³-Banking
高工具
40
33 / 167
τ³-Banking
最高工具
41.40
28 / 167
τ³-Banking
极高工具
43.10
24 / 167

金融

共 3 项评测
评测名称 / 模式
得分
排名/总数
71.70
7 / 42
Tax Agent Bench
最高工具
63.34
12 / 20
Finance Agent v2
最高工具
53.54
23 / 43

法律

共 2 项评测
评测名称 / 模式
得分
排名/总数
39.42
20 / 42
5.42
22 / 43

数学

共 3 项评测
评测名称 / 模式
得分
排名/总数
99
3 / 28
97.60
1 / 42
2.94
1 / 5

程序生成与编辑

共 3 项评测
评测名称 / 模式
得分
排名/总数
89.59
5 / 61
64.50
2 / 7
53.30
4 / 11

漏洞利用

共 3 项评测
评测名称 / 模式
得分
排名/总数
ExploitBench
最高工具
100
1 / 3
42.40
1 / 2

文档与图表理解

共 5 项评测
评测名称 / 模式
得分
排名/总数
30.40
5 / 122
30.40
5 / 122
31
3 / 122
GDP.pdf
最高
31
3 / 122
GDP.pdf
极高
32.20
2 / 122

专业数据分析

共 2 项评测
评测名称 / 模式
得分
排名/总数
AA-AnalystAgent
最高工具联网
51.25
4 / 29
40.90
1 / 2

界面定位

共 1 项评测
评测名称 / 模式
得分
排名/总数

设计与工程制图

共 2 项评测
评测名称 / 模式
得分
排名/总数
BenchCAD
最高工具
95.90
1 / 2
50
1 / 2

音乐创作

共 1 项评测
评测名称 / 模式
得分
排名/总数

维护、优化与工程管理

共 4 项评测
评测名称 / 模式
得分
排名/总数
SRE-Bench
最高工具
99.20
1 / 2
SRE-Bench
最高工具
88
1 / 2
Code Migration
最高工具
67.74
1 / 43
63.90
1 / 2

生物与基因

共 2 项评测
评测名称 / 模式
得分
排名/总数
60.30
1 / 2
37.10
1 / 2

化学与药物研发

共 1 项评测
评测名称 / 模式
得分
排名/总数
49.30
1 / 2

医学知识与健康咨询

共 1 项评测
评测名称 / 模式
得分
排名/总数

漏洞发现与分析

共 1 项评测
评测名称 / 模式
得分
排名/总数
SEC-Bench Pro
最高工具
85.40
1 / 6

智能体操作安全

共 2 项评测
评测名称 / 模式
得分
排名/总数
2.40
1 / 2

安全边界与拒绝

共 2 项评测
评测名称 / 模式
得分
排名/总数
Circumvention
最高工具
0
1 / 2
0
1 / 2

事实可靠性与幻觉

共 2 项评测
评测名称 / 模式
得分
排名/总数
100
1 / 1
4.20
1 / 2

长文定位与检索

共 2 项评测
评测名称 / 模式
得分
排名/总数

机器学习工程

共 1 项评测
评测名称 / 模式
得分
排名/总数

编码综合评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
61.60
2 / 11

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
IOI (Vals v2)
最高工具
100
1 / 26

临床工作与医疗决策

共 2 项评测
评测名称 / 模式
得分
排名/总数
MedScribe
最高工具
87.91
11 / 66
MedCode
最高工具
48.49
20 / 64

多轮记忆与持续上下文

共 1 项评测
评测名称 / 模式
得分
排名/总数
EBR-bench
最高工具
76.19
1 / 23

和其他模型对比

GPT-6 Astra

发布机构

OpenAI GPT-6 Astra

模型解读

GPT-6 正式型号:GPT-6 Astra

GPT-6 Astra 是 OpenAI 于 2026 年 9 月 3 日发布的旗舰推理模型,官方 API 模型 ID 为 gpt-6-astra。它面向复杂推理、软件工程、计算机操作、研究与文档创建,并强调把多步骤工作从初始请求推进到完整结果。此前站内分别收录的 GPT-6 与 Astra 传闻现已由官方名称统一确认;本页是两者的正式归一化记录。

规格与模态

  • 上下文窗口:1,050,000 tokens
  • 最大输出:128,000 tokens
  • 知识截止:2026 年 4 月 30 日
  • 输入:文本、图像
  • 输出:文本
  • 推理强度:low、medium、high、xhigh、max;不支持 none

OpenAI 没有公开参数总量、激活参数或模型架构,因此这些字段继续留空。官方仅确认其具备多语言能力,没有给出可核验的语种数量或完整 BCP-47 清单。

Agent 与工具能力

GPT-6 Astra 支持流式输出、函数调用、结构化输出,以及 Responses API 中的 Web search、File search、Image generation、Code interpreter、Hosted shell、Apply patch、Skills、Computer use、MCP 与 Tool search。新能力包括异步工具调用、WebSocket 中途指令调整,以及在不中断提示缓存前缀的情况下用 configuration_update 调整后续轮次的推理强度。虽然模型也支持 Chat Completions,但工具调用需要 Responses API。

价格

标准短上下文价格为每百万 tokens:输入 10 美元、缓存读取 1 美元、缓存写入 12.50 美元、输出 50 美元。当单次请求的输入超过 272K tokens 时,整次请求按长上下文费率计价:输入 20 美元、缓存读取 2 美元、缓存写入 25 美元、输出 75 美元。Batch 与 Flex 为 Standard 的 50%,Fast mode 为适用费率的 2 倍。区域处理可能另有 10% 加价。

访问状态

模型于 2026 年 9 月 3 日分阶段放量:首批仅向 Daybreak(OpenAI 申请制网络安全项目)的获批客户开放,ChatGPT Plus、Pro、Business、Enterprise 以及 OpenAI API(标识 gpt-6-astra)、Amazon Bedrock、Microsoft Azure 在随后数日陆续开放。不同渠道的能力并不一致:标准 API 与 ChatGPT 版本会拒绝漏洞挖掘等高级攻击性任务,只有经审核的防守方通过 Daybreak Blue 获得更宽的权限。由于仍处于分阶段放量,本页暂标记为 Preview,待官方确认全面开放后再升级为 GA。

关于GPT-6 Astra是否普通的plus订阅可用

目前的消息比较混乱,虽然官方在不同社交媒体上说明普通的plus用户可以使用,但是根据官方文档的说明,ChatGPT中GPT-6-Astra就是以GPT-6 Pro存在,按照这个理解,ChatGPT的plus就是没办法使用,根据当前已有的信息,我们总结如下:

套餐Chat:GPT-6 Pro = AstraChat 额度Work/Codex:GPT-6 AstraWork/Codex 额度
Free / Go❌—❌ Astra 未明确包含Codex 可用 Terra
Plus $20❌—官方总发布说明把 Plus 列入 Astra rollout 范围,但当前专门的 Astra 段落只明确写 Pro plan官方目前没有公布一个 Plus 的 Astra 固定额度表
Pro $100✅50 条/周,与 GPT-5.6 Sol Pro 共用✅Pro 总 allowance 为 Plus 的 5×
Pro $200✅200 条/周;Sol Pro 另有 170/天,并有二者合计 200/天限制✅Pro 总 allowance 为 Plus 的 20×
Business Standard✅15 条/月,与 Sol Pro 共用✅Astra 约 3–30 local messages / 5h
Business Premium✅50 条/周,与 Sol Pro 共用✅Standard 的 5× included usage,且没有 5-hour limit
Enterprise✅,受 workspace 权限控制取决于企业配置✅,逐步 rollout取决于 workspace / credits

官方评测

OpenAI 在 GPT-6 Astra 发布页末尾公开了 9 类、40 条评测结果,覆盖计算机操作、专业工作、编程、学术、科学与健康、网络安全、对齐、长上下文和抽象推理。本站已按发布页逐项录入,并保留 OSWorld 2.0 offline partial、ScreenSpot-Pro no-tools、HLE with tools、HealthBench Professional length-adjusted、两个 MRCR 区间等测试条件。ARC-AGI-3 一项本站采用 ARC Prize 官方复核的 62.7%(Semi-Private 半私有集、Standard harness、max effort、成本 26,098 美元),而非 OpenAI 发布页引用的 99.9%。后者出自 OpenAI 自建的 Provider Adapter harness(high effort、成本 18,817 美元),该脚手架会在多次请求之间保留不透明的推理状态,与其它厂商的成绩不可横向比较;两个数字均为该基准的最高水平,本站在榜单中只保留可比口径的那一个。官方说明这些数值取各 effort 设置中的最高结果,运行环境可能是 OpenAI research environment 或 API,因此统一标记为“模式未注明”,不能概括成单一 max 档位。计算机操作安全、AutoReview、circumvention、ExploitGym honeypot 和 hallucination 五项为数值越低越好。

官方来源

GPT-6 Astra

常见问题

GPT-6 和 Astra 是两个不同模型吗?

不是。OpenAI 的正式产品名是 GPT-6 Astra,API 标识为 gpt-6-astra。DataLearner 过去的 GPT-6 与 Astra 传闻条目已归一化为同一正式型号,旧地址会跳转到本页。

GPT-6 Astra 什么时候发布?

OpenAI API 更新日志记录的发布日期是 2026 年 9 月 3 日。首批仅向申请制网络安全项目 Daybreak 的获批客户开放,ChatGPT Plus、Pro、Business、Enterprise 以及 OpenAI API、Amazon Bedrock、Microsoft Azure 在随后数日分批获得访问权限。

GPT-6 Astra 的上下文窗口和最大输出是多少?

官方模型页给出的上下文窗口是 1,050,000 tokens,最大输出是 128,000 tokens,知识截止日期为 2026 年 4 月 30 日。

GPT-6 Astra 的 API 价格是多少?

标准短上下文每百万 tokens 输入 10 美元、缓存输入 1 美元、缓存写入 12.50 美元、输出 50 美元。输入超过 272K tokens 时,整次请求分别按 20、2、25、75 美元计价。Batch 和 Flex 为标准价的一半,Fast mode 为适用费率的两倍。

GPT-6 Astra 支持哪些推理强度?

支持 low、medium、high、xhigh 和 max,不支持 none。迁移时若原请求使用 none 或 minimal,OpenAI 建议从 low 开始测试。

GPT-6 Astra 支持哪些输入和工具?

支持文本和图像输入、文本输出,并支持流式输出、函数调用、结构化输出、Web search、File search、Image generation、Code interpreter、Hosted shell、Apply patch、Skills、Computer use、MCP 和 Tool search。工具调用需要 Responses API。

GPT-6 Astra 的参数量和官方 benchmark 分数是多少?

OpenAI 尚未公开参数总量或激活参数。发布页已公开 9 类、40 条官方评测结果,本站已逐项收录;成绩是各 effort 设置中的最高值,不能统一解读为 max 档位,其中五项安全与幻觉率指标为数值越低越好。唯一例外是 ARC-AGI-3:本站采用 ARC Prize 复核的 62.7%(Standard harness),而非发布页引用的 99.9%(OpenAI 自建 Provider Adapter harness,跨厂商不可比)。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码