8月28日,腾讯混元发布并开源新一代旗舰 MoE 模型 Hy4 preview,同步在 WorkBuddy、CodeBuddy、元宝、ima 上线,WorkBuddy 与 CodeBuddy 前两周边「限时免费」。这是今夏国内开源旗舰中较早采用标准宽松许可(Apache 2.0)的模型之一,官方定性为「稳居开源模型第一梯队」的早期预览版本。
一、770B 总参、49B 激活、1M 上下文
Hy4 preview 采用 MoE 架构,总参数 770B、每 token 激活 49B,上下文长度 1M(百万 token),词表 120832,License 为 Apache 2.0;权重在 Hugging Face、ModelScope、GitCode、CNB 同步放出 BF16 与 FP8 两版。相比前代 Hy3(295B/21B/256K),总参与激活参数接近翻倍、上下文翻四倍。架构上采用 Gated DSA 注意力、identity Hyper-Connections 与内置 MTP 投机解码层(10B 总参/0.7B 激活),设计取向与 2026 年多个国产开源权重发布接近,并非独门路线。
二、盲测披露:领先幅度在「噪声内」
腾讯组织 163 名内部专家对 203 个工程任务做盲测,Hy4 均分 2.99(满分 4.00):对 GLM-5.3 胜 46.8%/平 12.8%/负 40.4%(对手均分 2.92),对 Kimi K3 胜 51.2%/平 7.9%/负 40.9%(对手均分 2.94)。值得肯定的是腾讯未裁剪对比——自有评测者在其自有任务上判竞争对手更好约五分之二。结论很直接:开源前沿能力已收敛到「误差范围内」,真正差异在价格、许可与部署 footprint。
三、能力边界与定位
Hy4 preview 在软件工程、办公分析、游戏开发与科学研究(分子动力学、凝聚态物理、经典几何难题等)上展示进展,并协同 CodeBuddy/WorkBuddy 打磨生产力体验。但模型明确为预览版:官方称预训练与后训练均有较大提升空间;且为文本-only、无视觉支持,过度推理与过度验证被列为已知缺陷。API 经腾讯云 TokenHub、OpenRouter 提供,输入价约 0.834 美元/百万 token。
四、客观看点:Apache 2.0 让「能不能放心商用」成为选型项
旗舰开源拼的不只是参数,还有许可友好度——Apache 2.0 显著降低企业法务与二次开发成本,可直接嵌进产品线。但 770B 级 FP8 权重约 770GB,多数团队会租而非本地跑;且公开跑分尚未经第三方独立复现,引用时应锚定 8/28 这一检查点、区分腾讯自报与独立验证。对开发者,与其追逐 0.07 分能力差,不如评估价格与 serving footprint。