阶跃星辰发布 Step 5 Preview:600B MoE 国产旗舰,单任务成本仅 Opus 5 的 1/8
Step 5 Preview 采用稀疏混合专家(MoE)架构,总参数量达 600B,但每个 Token 仅激活 27B 参数,支持 100 万 Token 上下文窗口,原生支持文本、图片与视频输入(官…
📑 本页目录
阶跃星辰发布 Step 5 Preview:600B MoE 国产旗舰,单任务成本仅 Opus 5 的 1/8
2026 年 9 月,国产 AI 大模型创业公司阶跃星辰正式发布新一代旗舰基座模型 Step 5 Preview。600B 稀疏 MoE 架构、100 万 Token 超长上下文、单任务成本仅为 Claude Opus 5 的八分之一——国产开源大模型阵营再添一员猛将。
一、技术架构:600B MoE 的“效率革命”
Step 5 Preview 采用稀疏混合专家(MoE)架构,总参数量达 600B,但每个 Token 仅激活 27B 参数,支持 100 万 Token 上下文窗口,原生支持文本、图片与视频输入(官方文档口径)。这一设计的核心逻辑在于:以极低的激活成本换取旗舰级能力。
阶跃星辰认为,过去大模型 Scaling 的核心是用更多计算换取更强智能,但随着模型规模扩大和智能体任务复杂度提升,计算成本快速攀升。因此,下一阶段模型 Scaling 的关键,是提升计算转化为智能的效率。从 Step 3.5 Flash、Step 3.7 Flash 到 Step 5 Preview,阶跃连续三代基座模型都延续了对这一命题的探索。
二、性能表现:跻身全球开源前三
在全球权威榜单 Artificial Analysis Intelligence Index 中,Step 5 Preview 获得 44 分(AA 实测口径),位居全球开源模型前三,排在其前面的开源模型是 Qwen3.8 Max 和 GLM-5.3。
在具体任务评测中,Step 5 Preview 展现出均衡的综合能力(均为官方发布口径):
- 软件工程:在 DeepSWE v1.1 测试中得分 67.7,超越 Kimi K3(67.5)和 GLM-5.3(66.9)
- 编程能力:StepCodeBench 得分 49.0,大幅领先 Kimi K3(43.9)和 GLM-5.3(40.2)
- 金融分析:FrontierFinance 评测得分 66.4,优于 GLM-5.3(64.1)和 Kimi K3(62.6)
- 跨领域深度研究:DRACO 评测得分 83.3,领先 GLM-5.3(82.3)
在公开和内部评估中,Step 5 Preview 在复杂软件工程任务(包括长程规划任务)、专业知识工作和金融领域等基准测试中均展现出较为均衡的综合能力,在 Agents’ Last Exam 的 CLI 子集 ALE-CLI、金融投资研究评测 FrontierFinance 以及跨领域深度研究评测 DRACO 上仅次于 GPT-6 Astra 或 Claude Opus 5。
三、长任务能力:连续 24 小时自主迭代
Step 5 Preview 的一大亮点是其长周期自主任务能力。在 24 小时 GPU Kernel 优化任务中,Step 5 Preview 将 MLA 内核峰值性能提升至 508 TFLOPS,超越 Claude Opus 5 的 493 TFLOPS(官方发布口径)。
阶跃为该模型建立了 StepCodeBench,覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。测试中,Step 5 Preview 能够覆盖多种编程语言,以及 Bug 修复、功能开发、代码重构、环境配置等真实开发任务。
一个典型案例是:模型能根据自然语言需求,自主阅读 ESP32 设备及相关 API 的大量开发文档,将一块 ESP32-S3 开发板改造成支持蓝牙按键与语音输入的 Vibe Coding 键盘。它不仅能写代码,还可以访问串口、获取截图、调用摄像头、模拟鼠标操作,并根据真实设备返回的状态和报错持续修改、运行和调试代码,连续执行超过 3 小时。
四、成本优势:单任务成本仅为 Opus 5 的 1/8

Step 5 Preview 最引人注目的标签是极致的性价比。据官方数据,该模型单任务成本仅为 Claude Opus 5 的八分之一。Artificial Analysis 的数据显示,Step 5 Preview 单次总开销为 0.71 美元(约合人民币 4.76 元),而 Claude Opus 5 为 5.86 美元(约合人民币 39.25 元)。
具体定价方面,Step 5 Preview 的 API 价格为每百万 Token 输入 7 元(缓存未命中)、0.35 元(缓存命中)、输出 20 元,可对标 DeepSeek-V4-Pro 的高峰时段定价。在输出速度上,Step 5 Preview 达到约 100 token/秒(AA 实测 99.8),也明显快于 Claude Opus 5 的 55.3 token/秒。
阶跃星辰在能力、成本、效率和场景覆盖之间寻求最大化平衡。在能力与成本的权衡中,常用“帕累托前沿”描述当前能够达到的最优边界。Step 5 Preview 将 Intelligence Index 与单任务成本之间的平衡进一步逼近更优解。
五、公司背景:国产大模型“六小虎”之一
阶跃星辰成立于 2023 年,总部位于上海,由微软前全球副总裁姜大昕博士创办并担任 CEO。2026 年 1 月,旷视科技联合创始人、千里科技董事长印奇正式出任董事长,与 CEO 姜大昕、首席科学家张祥雨(ResNet 作者)、CTO 朱亦博(前字节 AI Infra 负责人)组成核心管理团队(公司背景与融资信息据公开报道)。
融资方面,阶跃星辰于 2024 年 12 月完成数亿美元 B 轮融资,投资方包括腾讯、五源资本、启明创投等。2026 年 1 月完成超 50 亿元 B+ 轮融资,参与机构包括上国投先导基金、浦东创投、徐汇资本等上海国资,以及国寿股权、无锡梁溪基金等。此后,公司传出将完成近 25 亿美元新一轮融资,并已拆除红筹架构,加速赴港 IPO 准备(传闻口径,未官方证实)。
在商业化路径上,阶跃星辰选择了“AI+终端”路线,正在跑通 AI 大模型在汽车、手机两大消费终端的商业化链路,据公司预计今年阶跃大模型将“上车”超百万辆。
六、行业意义:国产开源大模型进入“效率竞争”时代
Step 5 Preview 的发布恰逢国产开源大模型密集上新期。2026 年 8 月以来,阿里 Qwen3.8-Max 首次开放权重,智谱发布 GLM-5.3,腾讯混元开源 Hy4 preview,面壁智能开源 MiniCPM5-2B。国产大模型正从“比规模”转向“比省钱”,智能密度正在取代参数规模,成为厂商较量的新战场。
据 Hugging Face 2026 年春季报告,中国自研开源模型下载占比达 41%,首次超过美国,成为该平台规模第一的开源模型供给方。OpenRouter 平台数据显示,开源模型处理的词元占比从 1 月的 34% 升至 6 月的 65%(行业报告口径)。
阶跃星辰在此时发布 Step 5 Preview,以 600B MoE 架构和仅为 Opus 5 八分之一的任务成本,将智能与成本之间的帕累托前沿进一步向外推移。正如阶跃所言:“推动技术范式的发展,需要同时推动这两条边界,让扩散开的前沿空间开启新的可能。”
Step 5 Preview 目前已全量开放,模型权重将于 10 月 15 日正式开源。这款模型的发布,不仅标志着阶跃星辰在开源大模型赛道上的持续深耕,也为国产大模型在全球竞争中开辟了一条“效率优先”的差异化路径。
📌 数据说明:本文关键数据经双源核验(2026-09-21):① 阶跃星辰官方开放平台文档(platform.stepfun.com,模型 ID step-5-preview,1M tokens 上下文、文本/图片/视频输入、最大输出 64k tokens);② Artificial Analysis 实测(Intelligence Index 44 分、单任务成本 0.7155 美元、输出速度 99.8 token/s、2026-09 发布)。600B MoE/27B 激活、DeepSWE/StepCodeBench/FrontierFinance/DRACO 等评测分数及 24 小时 GPU Kernel 优化数据为官方发布口径;公司融资为公开报道口径,新一轮融资与 IPO 为传闻未证实;Hugging Face/OpenRouter 数据为行业报告口径。