StepFun Step 5 Preview 发布:600B 参数登顶 OpenRouter
10月8日,AI 创业公司 StepFun 在模型托管平台 OpenRouter 上线旗舰大模型 Step 5 Preview。该模型采用稀疏混合专家(MoE)架构,总参数 6000亿(600B),每次推理仅激活 270亿(27B),并支持高达 100万 token 的上下文窗口,面向长代码库、金融文档等重量级智能体任务。

从公开基准看,Step 5 Preview 在软件工程类评测上表现突出:在 DeepSWE 上以 67.7% 超过 Kimi K3 的 67.5% 与 GLM-5.3 的 66.9%,在 ProgramBench 与 StepCodeBench 上同样领先。它支持文本、图像与视频输入,最大输出 6.4万 token,并具备工具调用、流式响应与提示词缓存。API 定价为每百万输入 token 1美元、输出 2.7美元,缓存读取低至 0.05美元。
发布节奏上,Step 5 Preview 上线仅一天便冲上 OpenRouter 趋势榜首位,Cline、OpenCode 与 Nous Research 的 Hermes Agent 等开发者工具已为其导入大量流量;OpenCode 还提供为期一周的免费试用。StepFun 宣布将于 10月15日放出开源权重,届时开发者可自部署这一 1M 上下文的编码向模型。

对开发者生态的影响在于,长上下文加稀疏激活的组合把“能吞下整个仓库、跨多步自我修正”的智能体工作成本压了下来。在通用大模型能力逐渐趋同的背景下,StepFun 选择以编码与金融等专业场景为切入点,和同期发布的图像生成、决策模型等一起,反映出 2026 年模型竞争从“参数军备竞赛”转向“推理成本与垂直落地”的明确走向。
背景上,2026 年开源权重阵营持续扩容:Mistral、谷歌、微软等纷纷放出可自部署模型,Step 5 Preview 以 600B 规模加入战局,将进一步拉低高性能自主编程智能体的使用门槛,也考验开源模型在终端任务与长文档处理上的真实稳定性。
读者评论 (0)
想参与讨论?请 登录 后发表评论。
还没有评论,欢迎抢沙发!