DataLearner 标志
ST

Step 5 Preview

预览版推理大模型编程大模型StepStep 5

StepFun Step 5 Preview

别名:Step5 Preview / Step 5 / 阶跃星辰 Step 5

发布时间: 2026-09-20更新于: 2026-09-20浏览量: 822
在线体验GitHubHugging Face对比
模型参数
6000亿
上下文长度
1M
多语言支持
支持
推理能力
4/5

阶跃星辰旗舰基座模型 Step 5 Preview 于 2026 年 9 月 20 日发布并同日通过官方产品与开放平台 API (模型 ID step-5-preview)提供服务。采用稀疏 MoE 架构,总参数 600B、每 token 激活约 27B、共 92 层,支持 100 万 tokens 上下文与文本/图片/视频输入,面向 AI 编程、软件工程与专业知识工作等 Agentic 场景。官方评测 GPQA Diamond 93.5%、Terminal-Bench v2.1 85.0%、BrowseComp 88.7%、MMMU-Pro 76.0%,Artificial Analysis 智能指数 44。发布时未开源,官方称 BF16 权重将于 2026 年 10 月 15 日释放。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Step 5 Preview

模型基本信息

推理过程
支持
思考模式
思考水平 · 中 (Medium) (默认)思考水平 · 低 (Low)思考水平 · 高 (High)
上下文长度
1M tokens
最大输出长度
1M tokens
模型类型
推理大模型
输入/输出模态
文本、图像、视频 → 文本
发布时间
2026-09-20
模型文件大小
暂无数据
MoE架构
是
总参数 / 激活参数
6000亿 / 270亿
知识截止
暂无数据
Step 5 Preview

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
Step 5 Preview

官方介绍与博客

DataLearnerAI博客
暂无
Step 5 Preview

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$1.00/ 1M tokens$2.70/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本-—$0.050/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Step 5 Preview

评测结果

Step 5 Preview 当前已收录的代表性评测结果包括 HLE(11 / 235,得分 59.40)、GPQA Diamond(14 / 253,得分 93.50)、SciCode(10 / 134,得分 58.90)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合知识考试

共 2 项评测
评测名称 / 模式
得分
排名/总数
HLE
高
46.50
53 / 235
HLE
高工具
59.40
11 / 235

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
93.50
14 / 253
20.90
35 / 204

事实查找与深度检索

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
高工具联网
88.70
7 / 58

跨长文理解与整合

共 1 项评测
评测名称 / 模式
得分
排名/总数
88.30
1 / 6

自主开发与终端任务

共 2 项评测
评测名称 / 模式
得分
排名/总数
85
19 / 57
33.30
27 / 98

跨应用与工具编排

共 6 项评测
评测名称 / 模式
得分
排名/总数
MCP-Atlas
高工具
85.60
5 / 44
74.10
6 / 14
Job Bench
高工具
59
6 / 8
51
1 / 1
APEX-Agents
高工具
37.80
6 / 7
29.50
10 / 24

仓库修复与多文件工程

共 3 项评测
评测名称 / 模式
得分
排名/总数
SWE-Marathon
高工具
72.70
1 / 7
DeepSWE
高工具
67.70
30 / 92
SWE-Atlas-QnA
高工具
63.60
1 / 6

程序生成与编辑

共 1 项评测
评测名称 / 模式
得分
排名/总数
Program Bench
高工具
80.50
2 / 15

机器学习工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
MLS Bench
高工具
40.50
4 / 6

跨行业工作评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
GDPval-AA v2
高工具
1571
3 / 4

办公与文档流程

共 3 项评测
评测名称 / 模式
得分
排名/总数
AA-Briefcase
高工具
1417
2 / 3
Office QA Pro
高工具
60.30
5 / 5
44
13 / 25

专业数据分析

共 1 项评测
评测名称 / 模式
得分
排名/总数
29.40
2 / 2

图像感知与视觉推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
76
78 / 229

科学计算与科研编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
58.90
10 / 134

客服与业务流程

共 1 项评测
评测名称 / 模式
得分
排名/总数
τ³-Banking
高工具
42.50
26 / 167

漏洞发现与分析

共 1 项评测
评测名称 / 模式
得分
排名/总数
CyberGym
高工具
84.70
4 / 11

文档与图表理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
14.80
62 / 122

和其他模型对比

Step 5 Preview

发布机构

StepFun Step 5 Preview

模型解读

简介

Step 5 Preview 是阶跃星辰(StepFun)新一代旗舰基座模型,于 2026 年 9 月 20 日正式发布,并在当日通过阶跃星辰自有产品与开放平台 API 提供服务,模型 ID 为 step-5-preview。官方定位是面向真实世界的 Agentic(智能体)任务,覆盖 AI 编程、软件工程、专业知识工作与金融分析等需要长上下文、多轮工具调用和持续执行的场景,而不仅是单轮问答。

架构与技术规格

据官方发布信息,Step 5 Preview 采用稀疏 MoE(混合专家)架构,总参数量 600B,每个 token 激活约 27B 参数,并采用「窄而深」的设计,共 92 层 Transformer。官方平台文档列出的规格为:100 万 tokens 上下文窗口,支持文本、图片与视频输入、文本输出,最大输出 100 万 tokens,并提供低/中/高三档思考强度。接口侧支持流式输出、工具调用(Function Calling)、JSON 模式与 JSON Schema 结构化输出,以及上下文缓存。

核心能力与基准评测

阶跃星辰公布的官方评测成绩包括:GPQA Diamond 93.5%,Terminal-Bench v2.1 85.0%,BrowseComp 88.7%,多模态基准 MMMU-Pro 76.0%。第三方评测机构 Artificial Analysis 独立测得其 Intelligence Index 为 44 分,阶跃星辰称该成绩在开源权重模型中位列前三(权重尚未开放,该分数基于 API 测得)。

与现有 Step 模型的关系

阶跃星辰此前公开的最新文本模型是 2026 年 5 月发布的 Step 3.7 Flash(面向 Agent 生产场景的高效率 Flash 模型)。Step 5 Preview 是同系列下一代规模更大的旗舰基座模型,官方尚未公布与 Step 3.x 之间的具体继承或蒸馏关系。

开源计划、访问方式与价格

发布当日模型权重尚未开源,仅可通过阶跃星辰开放平台 API 与官方产品访问;官方表示将于 2026 年 10 月 15 日释放 BF16 格式权重,届时适用的许可证尚未公布。官方价格为每百万输入 tokens 7 元人民币(命中缓存 0.35 元),每百万输出 tokens 20 元人民币;Artificial Analysis 记录的等价价格约为每百万输入 tokens 1.00 美元、输出 2.70 美元。

来源

Step 5 Preview

常见问题

Step 5 Preview 正式发布了吗?

已发布。阶跃星辰于 2026 年 9 月 20 日正式发布,并在当日通过官方产品与开放平台 API 提供服务,模型 ID 为 step-5-preview。

Step 5 Preview 开源了吗?

发布时尚未开源,仅提供 API 访问。官方称将于 2026 年 10 月 15 日释放 BF16 格式权重,届时适用的许可证官方尚未公布。

Step 5 Preview 的上下文和输入类型是什么?

官方开放平台文档标注上下文窗口 100 万 tokens,支持文本、图片和视频输入、文本输出,最大输出同为 100 万 tokens,并支持 low/medium/high 三档推理强度。

Step 5 Preview 的官方价格是多少?

官方定价页为每百万 tokens 输入 7 元(缓存命中 0.35 元)、输出 20 元。Artificial Analysis 测得的等值约为每百万 tokens 输入 1 美元、输出 2.7 美元。

Step 5 Preview 的能力水平如何?

官方公布 GPQA Diamond 93.5%、Terminal-Bench v2.1 85.0%、BrowseComp 88.7%、MMMU-Pro 76.0%;第三方 Artificial Analysis 智能指数为 44 分,阶跃星辰称其位列全球开源模型前三。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码