智能单价再往下探
9月20日,上海大模型企业阶跃星辰发布新一代旗舰基座模型Step 5 Preview,同步向第三方开放接口,并计划于10月15日开源完整权重。在Artificial Analysis综合智能指数(AA榜单)中,这款模型取得44分,跻身全球开源模型前三;按官方测算口径,其单任务成本约0.71美元,仅相当于Claude Opus 5的八分之一。能力往上走、价格往下压,国产大模型的竞争主线正从单点跑分转向效率比拼。
事件背景:稀疏架构压住成本
据人民网上海频道与环球网报道,Step 5 Preview采用稀疏混合专家(MoE)架构,总参数量600B,每个词元实际激活参数仅27B,支持100万词元上下文窗口,原生支持文本与视觉输入,定位为可持续处理复杂任务的主力工作模型,重点面向AI编程、软件工程、专业知识工作与金融等场景。
价格方面,该模型输入、输出定价分别为每百万词元1美元与2.7美元,AA榜单口径下单任务成本约0.71美元。榜单细分项中,软件工程评测得分67.7,排在GPT-6 Astra与Claude Opus 5两款闭源旗舰之后;金融基准FrontierFinance得分66.4,超过GPT-6 Astra。需要说明的是,上述评测成绩均为厂商与榜单披露口径,第三方复测数据尚未见到。
深度分析:帕累托边界成为新战场
大模型行业常用"帕累托边界"来描述能力与成本之间的平衡线:在线之内,多一分智能就要多付一份成本;边界向外推,意味着同样支出能换来更强能力。阶跃星辰表示,从Step 3.5 Flash、Step 3.7 Flash到本次的Step 5 Preview,连续三代模型都围绕"提升计算转化为智能的效率"迭代,新一代才进行实质性参数扩容。
行业观察者的看法更为冷静。快思慢想研究院院长田丰在接受每日经济新闻采访时分析,如果对标AA测算口径下DeepSeek V4.1 Flash约0.27美元的单任务成本,Step 5 Preview的0.71美元并不算低;推理硬件性能提升让全行业推理成本大约每12至18个月出现一次明显下降,仅靠价格牌容易被填平,真正的竞争在于持续下压成本曲线的工程能力(媒体报道口径)。
企业视角:选型与内容双线准备
这轮发布对企业有两层参考。选型层面,开源权重10月15日放出后,企业可以把模型放到私有环境实测自己的业务任务,用真实任务而非榜单分数做判断;接口已经开放,云端调用也能先小规模试跑,对比单位任务成本与交付质量再决定用量。
内容层面,成本更低的模型意味着AI搜索与智能体的调用频次会继续上升,企业页面被机器读取的机会随之增多。把产品参数、服务范围、价格区间写成机器容易提取的结构化内容,是争取AI搜索引用的基础功课,这也是生成式引擎优化(GEO)的核心动作之一。
趋势研判:效率曲线决定入口位置
从近期密集的国产模型更新看,单次榜单排名的含金量正在被稀释,能在成本曲线与智能曲线之间跑出更陡斜率的团队,才更容易被企业采购与AI检索生态长期采用。当低价高性能的模型成为AI搜索与智能体的底座,企业内容的可读性与口径一致性,会直接影响其在生成式引擎里的呈现。把基础事实写准、把结构做清,比追逐任何一次榜单波动都更持久。
信息来源
- 人民网上海频道,《小参数高性能,阶跃新模型全球开源前三》,2026-09-21,https://sh.people.com.cn/n2/2026/0921/c138654-41703001.html
- 环球网,《阶跃Step 5 Preview发布:瞄准AI编程、金融、专业知识等场景》,2026-09-20,https://3w.huanqiu.com/a/c36dc8/4THjxG9Q87C?agt=23
- 澎湃新闻,《阶跃星辰发布新旗舰Step 5 Preview,跻身AA榜单全球开源前三》,2026-09-20,https://m.thepaper.cn/newsDetail_forward_34110545

