9月20日,国内大模型公司阶跃星辰正式发布新一代旗舰基座模型 Step 5 Preview。这款模型重点面向 AI 编程、软件工程、专业知识工作以及金融等场景,目标是提升模型在真实世界 Agentic(智能体)任务中的综合表现,同时在能力与成本之间寻找更优的平衡点。据官方信息,Step 5 Preview 将在 10 月 15 日正式开源,这一时间节点也让外界对其开放生态的后续动作充满期待。
从技术架构来看,Step 5 Preview 采用稀疏 MoE(混合专家)架构,总参数量达到 600B,但激活参数仅为 27B。这种设计意味着模型在推理时只需调用部分参数,从而在保持较强能力的同时控制计算开销。模型支持 100 万 Token 的超长上下文窗口,并原生支持文本与视觉输入,能够处理更复杂的多模态任务。在软件工程、专业工作流和金融等场景中,Step 5 Preview 的表现尤为突出,官方称其在长期规划任务和专业知识工作基准测试中均有出色发挥。
最引人关注的是其成本优势。在最新的全球权威榜单 Artificial Analysis Intelligence Index(AA 综合智能指数)中,阶跃 Step 5 Preview 跻身全球开源前三,而单任务成本仅为 Claude Opus 5 的八分之一。这一数据直接回应了当前大模型行业的核心痛点:随着模型规模扩大和智能体任务复杂度提升,计算成本正在快速攀升。阶跃方面认为,过去大模型 Scaling 的核心是用更多计算换取更强智能,但下一阶段的关键在于提升计算转化为智能的效率。从 Step 3.5 Flash、Step 3.7 Flash 到 Step 5 Preview,阶跃连续三代基座模型都在探索这一方向。
从行业影响来看,Step 5 Preview 的发布进一步加剧了开源大模型赛道的竞争。此前,开源模型在综合智能指数上往往落后于闭源旗舰,而 Step 5 Preview 凭借 AA 榜单开源前三的成绩,证明开源模型同样可以逼近甚至在某些维度上挑战闭源顶尖水平。其 600B 总参数、27B 激活参数的稀疏 MoE 设计,也为行业提供了兼顾性能与效率的参考范式。随着 10 月 15 日正式开源,开发者社区有望围绕该模型构建更多 Agentic 应用,推动 AI 编程、金融分析等垂直场景的落地。对于企业用户而言,单任务成本降至 Claude Opus 5 的八分之一,意味着在同等预算下可以运行更多复杂任务,这可能会改变部分团队在选择基座模型时的成本核算逻辑。总体而言,Step 5 Preview 的亮相不仅是阶跃星辰自身技术路线的阶段性成果,也为开源大模型在真实世界任务中的竞争力提供了新的注脚。
