2026 年 10 月 9 日——阶跃星辰(StepFun)于美国中部时间 10 月 8 日宣布,其新一代旗舰基座模型 Step 5 Preview 正式上线模型聚合平台 OpenRouter,并从当日起在 OpenCode、Cline、Nous Research、KiloCode 等 Agent 开发平台陆续推出为期一周的免费访问。该模型采用稀疏 MoE 架构,总参数 600B、每 token 激活 27B,在 Artificial Analysis 综合智能指数(AA Intelligence Index)中获得 44 分,位列全球开源模型前三;据 AA 实测口径,其单任务成本为 0.71 美元,约为 Claude Opus 5(5.86 美元)的 1/8。

一、登陆 OpenRouter,一周免费访问陆续推开

StepFun 官方账号于当地时间 10 月 8 日 21 时 08 分(北京时间 10 月 9 日 11 时 08 分)发布消息:Step 5 Preview 已上线 OpenRouter,试用地址为 openrouter.ai/stepfun/step-5-preview。官方表示,该模型"为智能体任务和专业工作提供旗舰级智能,大幅降低任务成本",并向开发者提出"保留你的工作流,切换你的模型"(Keep your workflow. Switch your model.)的使用方式。

免费访问以一周为限,自 10 月 8 日起在 OpenCode、Cline、Nous Research、KiloCode 等 Agent 开发平台陆续推出。OpenRouter 页面信息显示,该模型于 2026 年 10 月 8 日在该平台发布,由 StepFun 官方作为唯一供应商提供推理服务,实测延迟 3.60 秒、吞吐速度约 52 tokens/s;页面同时显示,为该模型导流的主要应用包括 OpenClaw、Nous Research 的 Hermes Agent、Cline 与 Kilo Code。

二、模型规格与定价

Step 5 Preview 于 2026 年 9 月 20 日首次发布,API 同日开放。综合阶跃星辰官方披露与 OpenRouter 页面数据,模型规格与定价如下:

项目 数据
架构 稀疏 MoE(混合专家)
总参数量 600B
每 token 激活参数 27B
上下文窗口 100 万 tokens
最大输出长度 64,000 tokens(OpenRouter 页面口径)
输入模态 文本、图像、视频
输出模态 文本
工具调用 支持,另支持结构化输出
输出速度 99.8 tokens/s(AA 模型页口径)
API 定价(国际) 输入 1 美元/百万 tokens,输出 2.7 美元/百万 tokens
缓存定价 缓存读取 0.05 美元/百万 tokens,较标准输入便宜 95%
API 定价(国内) 输入 7 元/百万 tokens,输出 20 元/百万 tokens,缓存命中 0.35 元/百万 tokens

数据口径说明:国际定价来自 OpenRouter 页面与多家媒体评测,国内人民币定价来自阶跃星辰开放平台价目(据百度百家号、雪球等转述);缓存读取价格为 95% 折扣后的结果,与"隐式缓存读取仅 0.05 美元"的媒体评测口径一致。

三、成绩单:AA 44 分与"1/8 成本"的参照系

在 Artificial Analysis 综合智能指数中,Step 5 Preview 得分 44,位列全球开源模型前三;每经网报道称,排在其之前的开源模型为 Qwen3.8 Max(0902)与 GLM-5.3(max),两者均为 45 分。官方口径强调"单任务成本仅为 Claude Opus 5 的 1/8":据 AA 实测,Step 5 Preview 完成单个标准智能任务的加权平均成本为 0.71 美元,而 Kimi K3 Max 为 2 美元,Claude Opus 5 为 5.86 美元;雷峰网援引 AA 页面数据称,该成本在 654 个模型中位列第 4,约为 Kimi K3 的 35%。

分项评测方面,官方披露及媒体报道的数据包括:

评测项目 表现 来源
DeepSWE v1.1(软件工程) 67.7%,略高于 Kimi K3 与 GLM-5.3 每日经济新闻
FrontierFinance(金融投资研究) 得分高于 GLM-5.3、Kimi K3 与 DeepSeek V4.1 Flash 每日经济新闻
ALE-CLI(Agent 长周期 CLI 任务)、DRACO(跨领域深度研究) 仅次于 GPT-6 Astra 或 Claude Opus 5,领先其他参评开源模型 雷峰网(官方披露)
内外部专家 Coding 评测 约 70% 评测者认为可自主完成中高复杂度 Coding 任务 雷峰网(官方披露)

"1/8 成本"的参照对象为市面上价格最高的模型之一,对照口径不同结论亦有差异:每日经济新闻指出,若对标 AA 测算下参数规模相近的 DeepSeek V4.1 Flash(单任务成本 0.27 美元),Step 5 Preview 的 0.71 美元处于更高水平。快思慢想研究院院长田丰在接受每经采访时评价称,这是一次"教科书式的达标交卷",但"离真正的代际跃迁还差一步";国产大模型的密集更新正在稀释"分数领先"的含金量,值钱的不再是某一次登榜,而是能否在成本曲线与智能曲线之间持续跑出更陡的斜率。

四、发布背景与后续计划

Step 5 Preview 于 9 月 20 日发布,官方博客以"Advancing the Pareto Frontier"(推进帕累托前沿)为题,强调模型在智能与成本之间拓展最优边界。作为对照:与近期引发关注的 2.8 万亿参数模型 Kimi K3 相比,Step 5 Preview 以不到其五分之一的体量在 AA 指数上拿到相同分数;此前 Step 3.5 Flash(总参 196B、激活 11B)与 Step 3.7 Flash(总参 198B、激活 11B)两代模型参数规模几乎原地踏步,Step 5 Preview 是阶跃星辰首次实质性参数扩容。

据多家媒体报道,该模型权重计划于 10 月 15 日开放下载,截至发稿尚未放出,读者以官方渠道后续公告为准。另据每日经济新闻报道,阶跃星辰正处于赴港 IPO 关键窗口,此次模型发布与多平台免费推广处于这一时间节点之内。

从 9 月 20 日发布到 10 月 8 日登陆 OpenRouter,Step 5 Preview 走的是"API 先行、聚合平台铺量、权重随后开源"的路径:先以价格与榜单成绩吸引开发者,再借助 OpenCode、Cline、KiloCode 等已在开发者工作流中扎根的 Agent 平台降低试用门槛。为期一周的免费访问结束后,能否留住用户,取决于其在真实 Agent 工作流中的稳定性表现。