GEO资讯

腾讯混元开源 Hy3,ASR 3.0 抢攻语音

发布于 2026/8/25 56 次阅读
腾讯混元开源 Hy3,ASR 3.0 抢攻语音

295B 参数的"小而强"

8 月初,腾讯混元把最新旗舰 Hy3 推向全球,并同步开源。据 O'Reilly 8 月趋势综述与多家开发者媒体的技术拆解,Hy3 采用 MoE 混合专家架构,总参数 2950 亿、每 token 仅激活 210 亿,支持最长 256K 上下文,并以 Apache 2.0 协议在 Hugging Face 等平台开放权重。第一财经 8 月 23 日的报道进一步确认,Hy3 延续快慢思考融合设计,常识错误率较预览版下降约一半,幻觉率下降超一半。

有意思的是它的定位思路:不拼绝对参数规模,而拼"单位推理成本"。激活参数只有 21B,意味着单次推理的算力开销接近 70B—100B 稠密模型,能力却逼近 200B—300B 级别。对要跑大量自主调用的智能体工作流,这种结构直接省真金白银——调用越频繁,省得越多。

一周登顶 OpenRouter,API 调用涨 68 倍

开源策略很快转化为采用量。多家媒体援引腾讯数据称,Hy3 预览版上线后 API 调用量较上一代增长 68 倍,发布一周内登上 OpenRouter 全球大模型调用量榜首。OpenRouter 这类"模型网关"的走红本身也是个信号——开发者越来越习惯在一个入口里按需切换多家模型,按任务挑最划算的那个,而不是锁死在某一家。

对国内企业而言,这层意义不小:过去接大模型常被某家云绑定,现在通过网关可以"哪家用得顺手用哪家"。Hy3 能快速登顶,正因为它的开源协议宽松、接口标准、容易被第三方工具接纳。

不只是聊天:WorkBuddy 与语音双线

Hy3 的落点明显偏向"能干活的 AI"。腾讯将其嵌入 WorkBuddy 办公智能体,内部测试称任务成功率超 90%、平均完成时间缩短 34%。与此同时,混元在 8 月 4 日发布语音识别模型 Hy ASR 3.0 Preview,已上线腾讯云及元宝(国泰海通 8 月策略报告提及)。文本与语音两端同步推进,指向的是更完整的多模态交互入口,也为客服、质检、会议这类场景留出空间。

一个细节值得注意:混元近期透露,HY3 Preview 上线后日均 token 消耗量增加了 20 倍,WorkBuddy 上自主选择 Hy3 的用户数增长了 6 倍。这些"被用起来"的指标,比任何榜单都更能说明问题。

为什么 256K 上下文值得在意

很多技术文章把"上下文长度"当成参数炫耀,但对实际业务,它决定了一件事:模型能不能一次性吃下你的完整知识库、合同、产品手册,而不用反复切片。256K 约等于一本中等厚度书籍的篇幅,足够把一家中小企业的核心资料整段喂进去,让 Hy3 在回答时带着完整上下文,而不是只看摘要。

这对客服知识库、内部培训、合规问答这类场景,价值远比"能聊更长"来得实在。一个带着完整背景回答的模型,比一个只能看片段的模型,给出的答案更准、更难闹笑话。对企业 GEO 来说,把自有知识结构化地喂给这类长上下文开源模型,也是让品牌信息被准确引用的现实路径之一。

给企业的参考

第一,开源协议要盯紧。Hy3 选 Apache 2.0,企业可无限制商用、修改、闭源衍生,这对中小企业尤其友好;选型时别只看能力,也要看"用了之后能不能放心商用",协议卡脖子的事在行业里并不罕见。

第二,关注"网关友好度"。模型能否方便地接进 OpenRouter、Cline、Cherry Studio 这类开发工具,决定了它能否真的融进你现有的工程栈。一个能塞进多模型编排的模型,比一个能力强但封闭的模型更实用。对已经跑起智能体工作流的企业,这点尤其关键。

信息来源

O'Reilly《Radar Trends to Watch: August 2026》(2026-08)

第一财经《姚顺雨之后,又一名前 OpenAI 研究员加入腾讯》(2026-08-23)

Open Source For You《Tencent Expands Hy3 AI Model To Global Enterprise Markets》(2026-08)