姚顺雨的半年考,Hy3的“三板斧”:腾讯AI放弃内卷,选择务实翻盘
日期:2026-07-09 22:23:50 / 人气:52

2026年7月,腾讯混元Hy3正式版落地。这是首席AI科学家姚顺雨入职腾讯、执掌混元研发体系后,交出的首份半年期大考答卷。
这场迭代看似低调,却彻底暴露了腾讯AI的全新战略取舍。当行业集体陷入“堆参数、冲榜单、卷多模态”的内卷竞赛时,混元主动跳出军备竞赛,锚定编码能力、长上下文、低幻觉三大核心方向持续深耕。外界质疑其“只会三板斧、陷入能力单一陷阱”,实则是姚顺雨为深陷节奏落后、落地疲软困境的腾讯AI,选定的务实破局之路。
如今的混元,技术数据显著修复、内部落地效率大幅提升,但用户留存、市场声量、内部信任的短板仍未补齐。Hy3的半年迭代,只是腾讯AI翻盘路上的第一步,未来仍面临双向博弈与终极考验。
01 74天迭代:三组核心数据,修复混元核心短板
今年4月,混元Hy3 Preview预览版发布,295B的参数规模,在行业万亿参数扎堆的第一梯队中并不亮眼,彼时业内普遍存疑:偏小的参数体量,能否支撑主流商用与产业落地需求?
时隔74天,Hy3正式版用实测数据给出答案,彻底补齐前代核心短板,多项关键指标实现跨越式提升,且全部聚焦业务落地刚需。
权威盲测层面,270位行业专家基于真实工作场景测评,Hy3综合得分2.67/4,超越GLM5.1的2.51/4,尤其在前端开发、数据与存储、CI/CD工程化场景中优势突出,适配互联网产业真实工作需求。
用户体验核心痛点全面改善:模型幻觉率从12.5%腰斩至5.4%,常识错误率从25.4%降至12.7%,两大核心瑕疵近乎减半,彻底改善过往被用户诟病的“胡说八道”问题。
落地效率大幅跃升,腾讯内部办公智能体WorkBuddy任务成功率从72%飙升至90%,任务平均耗时缩短34%,实用性、稳定性显著升级。而此次迭代并未改动基础配置,256K超长上下文窗口保持不变,延续了自身核心优势。
纵观Hy3的数次更新,始终坚守统一迭代逻辑:反复打磨编码、上下文、抗幻觉三大能力。看似迭代维度单一,实则精准踩中腾讯生态的核心刚需,也是大模型规模化落地的基础门槛。
腾讯全系核心业务——微信、QQ、游戏、广告、企业服务,底层均高度依赖代码支撑,强悍的编码能力是各类AI智能体落地的核心底座;256K长上下文决定了智能体能否处理复杂、连续的长链条任务;而极低的幻觉率与错误率,是产品留住普通用户、实现常态化使用的核心前提。
不同于DeepSeek V4等创业公司模型全面冲刺推理、多模态、成本效率的全维度突破,混元彻底放弃“全面开花、榜单内卷”的路线,坚定落地优先、刚需优先,先筑牢底层地基,再拓展上层能力。
02 组织重构+Co-design方法论:姚顺雨的救局逻辑
姚顺雨2025年9月低调入职腾讯,12月正式官宣执掌混元核心研发体系。上任后,他没有急于调整模型参数、跟风卷榜单,而是率先完成顶层组织重构,为混元迭代扫清体系障碍。
他全面重构预训练与强化学习基础设施,新设AI Infra、AI Data等核心底层部门;2026年3月,腾讯正式撤销成立十年的AI Lab,将分散的核心研发力量全部收拢至混元主线,结束过往研发资源分散、方向混乱的乱象。
与此同时,姚顺雨确立了混元核心迭代方法论——Co-design(边训边用),让产品真实反馈反向倒逼模型迭代升级。他曾明确表示,Hy3 Preview的发布,标志着混元从“读万卷书”的纯技术训练,转向“行万里路”的产品化落地新阶段。
激进改革的背后,是腾讯AI迫在眉睫的危机,混元早已没有慢慢试错的资本。
2026年1月腾讯内部年会,管理层直接点破混元过往的核心弊病。刘炽平用“高中生背题应考”比喻其旧有模式:榜单数据好看、纸面参数亮眼,但真实场景落地漏洞百出。马化腾的评价更为直白:混元整体迭代节奏,落后行业9个月至1年。
市场数据更是刺眼。春节红包大规模拉新过后,元宝独立App日活从峰值回落至900万,月活仅5735万;同期竞品豆包独立App月活高达3.45亿,双方体量差距接近6倍,留存率差距更为悬殊。
比外部落后更致命的,是内部失势。长期以来,混元模型能力不稳定、实用性不足,导致腾讯内部各业务线“不敢接、不想接”,宁可舍弃自研模型,外接第三方技术方案。大厂自研大模型,在自家生态中无法站稳主桌,成为腾讯AI最大的尴尬。
基于此,姚顺雨放弃了“参数堆砌、技术炫技”的内卷路径。在参数、声量、用户基数全面落后的局面下,腾讯唯一的破局点,是依托自身14亿MAU的超级生态,用场景优势弥补纯技术短板。
团队明确300B级参数是当前“能力与效率的最优平衡带”,主动放弃万亿参数内卷。而可量化、高刚需、适配内部业务的编码能力,成为混元打开内部落地僵局、重建业务信任的最佳切口。所谓的“三板斧”,不是能力局限,而是主动的战略取舍。
03 数据回暖但人心未归:迭代的半胜与半败
Hy3正式版交出的技术数据足够亮眼,但核心问题依然悬而未决:技术指标升级,并未完全转化为用户留存与内外信任。
从纸面数据看,Hy3迭代成效显著:WorkBuddy任务成功率大幅提升,专家盲测超越竞品,幻觉率、错误率近乎腰斩,日均Token消耗自预览版上线以来增长20倍,WorkBuddy主动选用Hy3的用户数暴涨6倍,产品实用性肉眼可见升级。
但亮眼的内部测评数据,存在天然局限性。任务成功率的定义权掌握在腾讯内部,标准化测评场景,与复杂多变的真实用户场景存在明显差距;270位专业专家的盲测结果,无法等同于海量普通用户的日常使用体验。
最直观的佐证是产品留存:元宝App功能持续完善,已全面支持PPT、Word、Excel、PDF、HTML全类型文件生成,但春节拉新红利消退后,用户规模持续回落,留存疲软的问题并未改善。技术参数持续优化,用户底盘却没有同步扩张。
内部信任裂痕也未彻底修复。据腾讯内部员工反馈,在部分复杂任务场景中,混元效率仍不及Claude、GLM等外部模型。为扶持自研模型,腾讯对外部模型设置调用额度限制,这种“行政强制优先”的推广模式,引发业内争议:混元的落地增长,究竟是产品实力驱动,还是内部资源倾斜驱动?
简言之,姚顺雨用半年时间,修好了混元的技术短板,却尚未修好市场与内部业务的信任短板。
04 终极二元结局:是务实扎根,还是舒适区陷阱?
当下的混元,正站在战略分叉口,姚顺雨“聚焦三板斧、放弃全面内卷”的抉择,将直接决定腾讯AI未来数年的走向,最终结局无外乎两种。
第一种,赌赢:从内部工具,走向生态底座。
编码、长上下文、低幻觉三大基础能力,是所有AI应用、智能体、生态落地的核心根基。当这三项能力打磨至行业极致,腾讯14亿MAU的超级生态与海量场景优势将彻底释放。
届时,混元将摆脱“勉强够用的内部工具”定位,深度嵌入微信、QQ、企业微信、腾讯文档、游戏、广告全链路,成为腾讯全系产品不可或缺的AI底层底座。复刻微信从QQ附属品成长为独立生态帝国的路径,实现从“够用”到“离不开”的质变。
第二种,赌输:深耕刚需沦为能力陷阱。
过度聚焦三大基础能力,必然挤占多模态、深度推理、创意生成、前沿创新等赛道的研发资源。当行业对手持续迭代万亿参数、通用多模态、沉浸式AI能力,不断拉开上限差距时,混元的“够用”终将变成“不够用”。
在用户需要极致创意、复杂推理、跨模态联动的高阶场景中,Hy3的能力短板将彻底暴露,陷入“基础扎实、上限不足”的被动局面,错失AI下半场的通用能力竞赛。
结语
姚顺雨的半年答卷,足够清醒、足够务实。他接手的是一个节奏落后、落地薄弱、内外失势的混元,没有资本跟风内卷、盲目追高。主动收缩战线、聚焦核心刚需、深耕落地能力,是短期内最稳妥、最高效的破局之路。
但补齐地基,只是入场的第一步。大模型的终极竞争,终究是底层扎实度与能力上限的双重比拼。
Hy3用半年时间证明,腾讯AI已经告别盲目跟风的混乱期,找到了清晰的落地节奏。接下来的考验更为关键:深耕“三板斧”筑牢根基之后,腾讯能否跳出舒适区,在稳住落地优势的同时,补齐高阶能力、赢回用户与市场信任,真正走出属于自己的AI突围之路。
作者:欧皇娱乐
新闻资讯 News
- 宇树会成为第二个中石油吗?08-22
- 王宁为何敢说,泡泡玛特今年完不...08-22
- 充电10分钟、续航3000里,押注全...08-22
- 最强生图模型将至?OpenAI秘密...08-22

