8月28日,腾讯混元正式发布并开源新一代大语言模型Hy4 preview。这距离腾讯2月重建基础设施、发布混元大模型大版本,仅过去半年时间。这一次,腾讯把参数规模、上下文长度和数据规模三个维度同时拉满:总参数770B、激活参数49B,上下文长度突破1M(约百万级),定位直指”为生产力而生”。
一份盲测成绩单:正面硬刚GLM和Kimi
Hy4 preview发布最引人关注的,是一份第三方盲测数据。在163名专家、203个工程任务的盲测中,Hy4 preview得分2.99/4.00,略优于GLM 5.3的2.92和Kimi K3的2.94。虽然差距看似微小,但考虑到这三个模型都处于开源第一梯队,任何一分差距都代表实打实的工程实力。

腾讯方面表示,Hy4 preview通过预训练和后训练的共同进步实现智能水平提升,在代码、办公、科学等任务上表现突出。这也解释了”为生产力而生”的定位——它不追求聊天炫技,而是奔着”干活”去的。
三个看点:自我进化、专家共建、普惠落地
第一个看点在于研发机制的改变。Hy4 preview首次参与训练方法、数据策略、评估体系等环节的自动优化,形成递归自我改进闭环。通俗讲,就是模型开始”参与”自己如何被训练,这在大模型研发中是个值得关注的信号。
第二个看点是数据共建模式。模型通过与软件工程、游戏、金融、安全等领域专家数据共建,并与WorkBuddy等产品深度协同,在软件工程、办公分析、游戏开发、科学研究等场景均有提升。

第三个看点是落地速度。Hy4 preview已在WorkBuddy/CodeBuddy国内外版本、元宝、ima等产品同步首发,并可通过腾讯云Tokenhub和OpenRouter接入API,延续了腾讯混元的普惠策略。
迭代节奏说明什么
自2月重建基础设施以来,混元大模型平均每两月迭代一次大版本。这种高密度迭代在国产大模型厂商中并不多见,背后是腾讯对基础设施的持续投入和产品化路线的清晰。
对开发者来说,Hy4 preview的百万级上下文意味着可以直接处理超长文档、大型代码库,配合”为生产力而生”的定位,很适合接进办公、编程、科研等真实工作流。对普通用户来说,元宝等产品已经内置,可以直接体验。
国产大模型的开源竞争正从”参数竞赛”转向”场景落地竞赛”,Hy4 preview这一枪,打得很响。



