GEO资讯

阶跃星辰发布Step 5 Preview,效率竞争成新主线

发布于 2026/9/22 9 次阅读
阶跃星辰发布Step 5 Preview,效率竞争成新主线

智能单价再往下探

9月20日,上海大模型企业阶跃星辰发布新一代旗舰基座模型Step 5 Preview,同步向第三方开放接口,并计划于10月15日开源完整权重。在Artificial Analysis综合智能指数(AA榜单)中,这款模型取得44分,跻身全球开源模型前三;按官方测算口径,其单任务成本约0.71美元,仅相当于Claude Opus 5的八分之一。能力往上走、价格往下压,国产大模型的竞争主线正从单点跑分转向效率比拼。

事件背景:稀疏架构压住成本

据人民网上海频道与环球网报道,Step 5 Preview采用稀疏混合专家(MoE)架构,总参数量600B,每个词元实际激活参数仅27B,支持100万词元上下文窗口,原生支持文本与视觉输入,定位为可持续处理复杂任务的主力工作模型,重点面向AI编程、软件工程、专业知识工作与金融等场景。

价格方面,该模型输入、输出定价分别为每百万词元1美元与2.7美元,AA榜单口径下单任务成本约0.71美元。榜单细分项中,软件工程评测得分67.7,排在GPT-6 Astra与Claude Opus 5两款闭源旗舰之后;金融基准FrontierFinance得分66.4,超过GPT-6 Astra。需要说明的是,上述评测成绩均为厂商与榜单披露口径,第三方复测数据尚未见到。

深度分析:帕累托边界成为新战场

大模型行业常用"帕累托边界"来描述能力与成本之间的平衡线:在线之内,多一分智能就要多付一份成本;边界向外推,意味着同样支出能换来更强能力。阶跃星辰表示,从Step 3.5 Flash、Step 3.7 Flash到本次的Step 5 Preview,连续三代模型都围绕"提升计算转化为智能的效率"迭代,新一代才进行实质性参数扩容。

行业观察者的看法更为冷静。快思慢想研究院院长田丰在接受每日经济新闻采访时分析,如果对标AA测算口径下DeepSeek V4.1 Flash约0.27美元的单任务成本,Step 5 Preview的0.71美元并不算低;推理硬件性能提升让全行业推理成本大约每12至18个月出现一次明显下降,仅靠价格牌容易被填平,真正的竞争在于持续下压成本曲线的工程能力(媒体报道口径)。

企业视角:选型与内容双线准备

这轮发布对企业有两层参考。选型层面,开源权重10月15日放出后,企业可以把模型放到私有环境实测自己的业务任务,用真实任务而非榜单分数做判断;接口已经开放,云端调用也能先小规模试跑,对比单位任务成本与交付质量再决定用量。

内容层面,成本更低的模型意味着AI搜索与智能体的调用频次会继续上升,企业页面被机器读取的机会随之增多。把产品参数、服务范围、价格区间写成机器容易提取的结构化内容,是争取AI搜索引用的基础功课,这也是生成式引擎优化(GEO)的核心动作之一。

趋势研判:效率曲线决定入口位置

从近期密集的国产模型更新看,单次榜单排名的含金量正在被稀释,能在成本曲线与智能曲线之间跑出更陡斜率的团队,才更容易被企业采购与AI检索生态长期采用。当低价高性能的模型成为AI搜索与智能体的底座,企业内容的可读性与口径一致性,会直接影响其在生成式引擎里的呈现。把基础事实写准、把结构做清,比追逐任何一次榜单波动都更持久。

信息来源