终于,腾讯混元3.0正式版(Hy3)正式上线。距离预览版发布已过去74天,这也是腾讯首席AI科学家姚顺雨加入后交出的首份正式成绩单。

7月6日,腾讯旗下AI助手元宝悄然部署了Hy3正式版。该模型依然采用快慢思考融合的MoE架构,总参数量295B,激活参数21B,最大支持256K上下文——参数规模与预览版完全一致。腾讯显然确立了明确方向:不盲目追求大参数,而是走“兼顾性能与性价比”的路线,目标是成为多数业务场景落地的最优解。
在腾讯的测算中,300B参数量是能力与效率的最佳平衡点。复杂推理、长上下文理解、指令遵循等能力,到这一量级已基本释放完毕;再往上堆参数,边际收益明显递减——投入翻倍,能力提升往往仅有几个百分点。这笔账算得相当清晰。
相比预览版,正式版重点打磨了三方面:Coding Agent任务执行与生产力场景、复杂推理和数理能力,同时修复了若干已知问题。与此同时,价格进一步降低——输入1元/百万tokens,输出4元/百万tokens,输入命中缓存仅需0.25元/百万tokens。这样的定价在当前市场中的竞争力显而易见。
目前Hy3已在腾讯内部的WorkBuddy、CodeBuddy、元宝、Marvis、ima等多个业务中上线,API也已登录腾讯云TokenHub,海外多个API平台后续将陆续接入。可以说,腾讯将此次发布视为AI下半场的一次节奏调整。
回顾2025年下半年以来,腾讯密集调整了混元大模型团队的组织架构与工作流程,2026年2月又重建了包括预训练和强化学习在内的研发基础设施,并提升了数据质量。姚顺雨曾表示,Hy3 preview只是混元大模型重建的第一步。
此次重建过程中,腾讯确立了三个实用性原则:一是能力要体系化,不搞“偏科”;二是评测要真实,主动远离那些容易被“刷榜”的公开榜单;三是死死咬住性价比。正因如此,腾讯选择先发布预览版,从开源社区和用户那里获取真实反馈,再反过来打磨正式版的实用性。
数据证明了效果。WorkBuddy上自主选择Hy3 preview的用户数增长了6倍,办公场景内部测评中,任务成功率从72%提升至90%,平均耗时缩短了34%。元宝方面,长文和AI搜索场景中的幻觉问题也得到改善——通过细粒度数据清洗和训练约束,模型学会了在复杂证据下更可靠地输出。基于元宝真实日志的评测显示,Hy3的常识错误率比预览版下降了一半,幻觉率下降超过一半。
值得一提的还有Agent能力的大幅提升。元宝同步上线了Agent功能——只要用户的任务prompt中明确要求生成PPT、Word、Excel、PDF、HTML等文件,它就能直接输出一份完整的文件,不再仅仅是以前那种纯对话式回答。实际体验下来,这项能力确实让“助手”二字更加名副其实。
