9月20日,阶跃星辰发布新一代旗舰基座模型Step 5 Preview,重点面向AI编程、软件工程、专业知识工作、金融等场景,提升模型在真实世界Agentic任务中的综合表现。在最新公布的全球权威榜单Artificial Analysis Intelligence Index(AA综合智能指数)中,阶跃Step 5 Preview跻身全球开源前三。据官方透露,该模型将于10月15日正式开源。
Step 5 Preview采用稀疏MoE架构,总参数量600B,激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入。这一参数配置意味着模型在保持大规模知识容量的同时,通过稀疏激活机制控制推理成本。在软件工程、专业工作流和金融等场景中,该模型表现出较强的任务处理能力。
成本效率是此次发布的核心关注点。官方数据显示,Step 5 Preview单任务成本仅为Claude Opus 5的1/8。在能力与成本的权衡中,行业常用“帕累托前沿”描述当前能够达到的最优边界,前沿越向外推,意味着同样的成本可以买到更强的智能。阶跃方面表示,Step 5 Preview将Intelligence Index与单任务成本之间的平衡进一步逼近更优解。
在公开和内部评估中,Step 5 Preview在复杂的软件工程任务(包括长期规划任务)以及专业知识工作和金融领域的基准测试中均表现出色。该模型的定位是可持续处理复杂任务的主力工作模型,面向真实世界的智能体任务场景。
阶跃在技术路径上提出了一个判断:过去大模型Scaling的核心,是用更多计算换取更强智能;但随着模型规模扩大、智能体任务复杂度提升,计算成本也在快速攀升。因此下一阶段模型Scaling的关键,是提升计算转化为智能的效率。从Step 3.5 Flash、Step 3.7 Flash到Step 5 Preview,阶跃连续三代基座模型都延续了对这一问题的探索。
当前大模型行业正从单纯的参数规模竞赛转向效率与场景落地的综合比拼。开源模型阵营中,如何在有限算力预算下实现接近闭源旗舰模型的智能水平,成为多家厂商的竞争焦点。Step 5 Preview以600B总参数、27B激活参数的配置进入AA榜单全球开源前三,并在单任务成本上对标Claude Opus 5给出1/8的数据,反映出国内基座模型厂商在推理效率优化上的持续投入。
随着10月15日正式开源日期的临近,Step 5 Preview在开发者社区和企業级AI应用中的实际表现将受到进一步检验。其在AI编程、金融分析等垂直场景中的落地效果,以及开源后围绕该模型形成的工具链和生态建设,将是观察其商业价值的关键维度。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。