阶跃发布Step 5 Preview开源Agent模型:600B参数、100万Token上下文
9 月 20 日,阶跃星辰发布旗舰基座模型 Step 5 Preview:稀疏 MoE 架构,总参数 600B、激活 27B,支持 100 万 Token 上下文,原生支持文本与视觉输入,权重计划 10 月 15 日释放。对跨境卖家而言,它的看点在长文档处理与多轮工具调用。
规格拆解:600B总参数、27B激活、100万Token上下文

按官方发布会口径,Step 5 Preview 是一款面向真实世界 Agentic(智能体)任务的旗舰基座模型,重点覆盖 AI 编程、软件工程、专业知识工作、金融等场景,目标是支撑需要长上下文、多轮工具调用和持续执行的工作流。
架构上是稀疏 MoE:总参数量 600B,每个 Token 激活参数约 27B。据每日经济新闻、雷峰网报道,模型采用 92 层的"窄而深"设计,官方说法是更深的层堆叠能在长预填阶段给隐式多步推理留出更长的信息通路。上下文窗口为 100 万 Token,原生同时接受文本与图像输入。
为了撑住百万级上下文的成本,官方披露了几项工程手段:SparseGQA(稀疏分组查询注意力)配合 token block merging(块级 Token 合并),据其称可把索引选取与 top-k 的开销降到更稠密基线的约 1/8;训练侧采用长程 on-policy 强化学习,并对 MoE 路由做训练与推理的比特级对齐。第三方技术媒体还提到 MTP-3 推测解码、FP8 MoE、KV 缓存卸载等推理优化。
以上参数均来自公开报道与官方发布会口径,本文不做性能承诺。
开源节奏:接口先行,10月15日释放权重


图片来源:雷峰网 — Artificial Analysis 智能指数榜单截图(https://www.leiphone.com/category/industrynews/yU1FPmKgLcs3SWmO.html)
Step 5 Preview 目前已经可以通过阶跃星辰开放平台调用。据官方开放平台页面,模型以 API 形式在线提供服务,同一套密钥可覆盖语言、语音、图像模型,并配有浏览器端试用的 Studio 与按月订阅的 Step Plan 套餐。
开源的安排是:官方计划在 2026 年 10 月 15 日释放这款 600B 参数模型的权重。也就是说,现阶段公开可用的只有接口与产品入口,自部署要等权重放出后才有条件。
命名上有个细节值得注意:这次发布的是"Preview"版本,官方在对外表述中也保留了这个后缀。对打算接入的业务方来说,Preview 通常意味着接口、价格与能力都可能继续调整,排期时留出弹性比较稳妥。
评测口径:AA榜单44分,官方称位列开源前三

据每日经济新闻、雷峰网等报道,在 Artificial Analysis 的 Intelligence Index(AA 综合智能指数)最新榜单中,Step 5 Preview 取得 44 分,官方表述为"跻身全球开源模型前三"。这里需要说明的是,榜单名次是第三方评测机构 Artificial Analysis 给出的结论,不是本站评价;同分位的还有第三方汇总提到的 Kimi K3(Max)。
第三方技术媒体还援引了其它基准的口径:官方自研的 StepCodeBench(553 个仓库、33 种语言)平均 49.0 分;Terminal-Bench 4.0 为 33%,SciCode 为 59%;官方资料中列出的 DeepSWE 为 67.7、ProgramBench 为 80.5。这些数字来自不同信源、口径不完全统一,且部分为厂商自研基准,横向比较时建议回到原始评测页核对。
也有第三方分析指出能力分布并不均衡:有知乎贡献者的早期实测认为,该模型在科学类编程任务上表现较好,但在事实性知识与复杂文档处理上仍有差距。这属于第三方观点,仅供参考。
成本与场景:官方称单任务成本约为Opus 5的1/8

成本是这次发布被提得最多的一点。据官方披露,Step 5 Preview 的单任务成本约为 Claude Opus 5 的 1/8。官方把这条与能力评分放在一起讲,说法是继续推进"智能与成本"的帕累托前沿。
具体价格方面,不同信源口径有差异:英文技术媒体汇总的接口价格是每百万输入 Token 1.00 美元、每百万输出 Token 2.70 美元;另一份技术汇总给出的国内口径是输入 7 元、输出 20 元、缓存 0.35 元(每百万 Token),输出速度约 100 tokens/秒。这些均为第三方汇总,实际计费请以阶跃星辰开放平台当期价格页为准。
另外,同场发布会还提到端侧模型 StepEdge、语音模型 StepAudio 3 Realtime 以及车端智能体等产品线。与本文主题相关的是模型本身,这部分不展开。
注意事项
第一,别把 Preview 当正式版来排产。权重要到 10 月 15 日才释放,接口能力、限速与价格都可能在正式版前调整。如果打算把它接进客服自动回复、多语言 listing 生成这类线上链路,建议先做灰度,保留可切换的备选模型,别做单点绑定。
第二,算成本要按自己的 Token 结构算,不要照搬"1/8"这个比值。单任务成本高度依赖输入输出比例、上下文长度和缓存命中率。跨境场景里常见的长商品库检索、多轮工具调用,输入侧 Token 占比通常很高,这类负载对缓存与长上下文的计费规则更敏感。拿真实业务样本跑一轮再定。
第三,榜单分数和能力不均衡的反馈都要看。AA 指数是第三方机构的人工+自动评测结果,只代表该报告覆盖的题集;第三方实测提到的知识准确性、复杂文档处理短板,恰恰是选品分析、合规文档这类跨境高频任务要用的能力。上线前用自己行业的真实问题集做一轮验收,比看总分更有效。
FAQ
Q:Step 5 Preview 现在能免费用吗?
A:模型已在阶跃星辰开放平台以 API 形式开放,同时官方提供浏览器端试用的 Studio 入口,以及按月订阅的 Step Plan 套餐;部分第三方渠道在发布期做过限免活动。具体免费额度、限速与计费规则属于商业政策,请以开放平台当期页面为准,本文不做承诺。
Q:600B 参数是不是意味着必须用很大的机器才能跑?
A:不是。600B 是总参数量,架构为稀疏 MoE,每个 Token 实际激活约 27B。不过本次发布的是 Preview 版本,权重计划 10 月 15 日才释放,现阶段公开可用的路径是调 API,自部署的显存与部署方案要等权重放出后再评估。
Q:AA 榜单上"全球开源前三"这个说法怎么理解?
A:这是第三方评测机构 Artificial Analysis 的 Intelligence Index 榜单给出的名次结论,据每经、雷峰网报道该模型取得 44 分。榜单反映的是该机构题集下的评测结果,同分位还有其它模型。引用名次时应注明机构与报告名称,不宜延伸理解为与某个具体产品的强弱对比。
参考来源
- 每日经济新闻:《阶跃星辰发布旗舰模型 Step 5 Preview》
- 雷峰网:《阶跃新旗舰 Step 5 Preview 发布,跻身 AA 榜单全球开源前三》
- 阶跃星辰开放平台(模型概览与接入方式说明页)
- 网易智能:《阶跃发布旗舰模型 Step 5 Preview:600B 参数 10 月 15 日开源》
- AGI Hunt(英文技术汇总):《StepFun releases Step5 Preview: 600B/27B MoE, 1M context》
- HuggingNews(英文技术汇总):《StepFun Launches 600B Step 5 Preview AI Model With Oct 15 Open Weights》
- AllWorld.Media:《StepFun releases preliminary version of Step 5》