开发者生态
morning
瞄准 AI 编程、金融等场景,单次成本仅为Opus 5 的1/8!这款国产旗舰模型跻身 AA 榜单全球前三
摘要
9 月 20 日,阶跃星辰发布新一代旗舰基座模型Step 5 Preview,重点面向AI编程、软件工程、专业知识工作、金融等场景,提升模型在真实世界Agentic任务中的综合表现,并进一步拓展智能与成本之间的最优边界。在最新的全球权威榜单Artificial Analysis Intelligence Index(AA综合智能指数)中,阶跃Step 5 Preview跻身全球开源前三。值得关注的...
Step
Preview
阶跃星辰发布新一代旗舰基座模型Step
重点面向AI编程
软件工程
专业知识工作
金融等场景
提升模型在真实世界Agentic任务中的综合表现
并进一步拓展智能与成本之间的最优边界
在最新的全球权威榜单Artificial
2026-09-21
1 阅读
约2分钟阅读
李冬梅
字号:
9 月 20 日,阶跃星辰发布新一代旗舰基座模型Step 5 Preview,重点面向AI编程、软件工程、专业知识工作、金融等场景,提升模型在真实世界Agentic任务中的综合表现,并进一步拓展智能与成本之间的最优边界。在最新的全球权威榜单Artificial Analysis Intelligence Index(AA综合智能指数)中,阶跃Step 5 Preview跻身全球开源前三。值得关注的是,该模型单任务成本仅为Claude Opus 5的1/8。据官方透露,该模型将于10月15日正式开源。 Step 5 Preview采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入,在软件工程、专业工作流和金融等场景表现突出。 在能力、成本、效率与场景覆盖之间寻求最大化平衡,是Step 5 Preview的核心卖点。模型面向真实世界的智能体任务,其定位是可持续处理复杂任务的主力工作模型。在能力与成本的权衡中,常用“帕累托前沿”描述当前能够达到的最优边界。前沿越向外推,意味着同样的成本可以买到更强的智能。而Step 5 Preview将Intelligence Index与单任务成本之间的平衡进一步逼近更优解。 在公开和内部评估中,Step 5 Preview在复杂的软件工程任务(包括长期规划任务)以及专业知识工作和金融领域的基准测试中均表现出色。 阶跃认为,过去大模型Scaling的核心,是用更多计算换取更强智能;但随着模型规模扩大、智能体任务复杂度提升,计算成本也在快速攀升。因此下一阶段模型Scaling的关键,是提升计算转化为智能的效率。从Step 3.5 Flash、Step 3.7 Flash到Step 5 Preview,阶跃连续三代基座模型都延续了对这一问题的探索。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱