腾讯混元 Hy4-preview 开源:770B MoE、激活 49B、1M 上下文
验证:✅已核一手(HuggingFace tencent/Hy4-preview + 腾讯混元官网公告,2026-08-31 核)。
时间线
| 日期 | 节点 |
|---|---|
| 08-28 | HuggingFace tencent/Hy4-preview 开源(另有 FP8 量化版 Hy4-preview-FP8,约 804B);腾讯混元官网同步发布公告 |
| 08-29 | 橘鸦等中文聚合源报道,附内部盲测对比说法 |
硬参数(一手)
- 总参数 770B / 激活 49B(MoE)——本周开源阵营最大体量
- 上下文 1M tokens
- 许可证:Apache 2.0(商用友好)
- 版本:Hy4-preview(约 780B,text-generation)+ Hy4-preview-FP8(约 804B)
- HF 组织:
tencent(注意:不在 Tencent-Hunyuan 老组织,核实时差点漏掉)
官方叙事
- 主打真实生产力任务:AI 编程/代码、办公分析、游戏开发、科学研究
- 自称「首次参与训练自己」(self-improvement:预训练与后训练同步进步)——若属实是训练范式的看点,但缺技术报告佐证,成稿时注明为官方说法
- 官方称内部盲测略优于 GLM-5.3 和 Kimi K3(⚠️官方口径,无第三方验证)
- 定位「稳居开源模型第一梯队」
为什么重要
- 开源旗舰再添一极:770B 体量 + 1M 上下文 + Apache 2.0,与 GLM-5.3-Flash(性价比)、Qwen3.8-Flash-Next(新架构)、Granite 4.2(企业向)同周齐发——开源阵营的「四箭齐发」本周;
- MoE 军备竞赛:770B/49B 激活 ≈ 6.4% 激活率,与 GLM-5.2 的 3.5% 路线不同取舍(更大专家池 vs 更稀疏激活)——技术对比角度有料;
- 「模型参与训练自己」若可验证,是 self-improvement 路线的重要信号。
各方反应
- 社区关注度高但第三方评测尚少(preview 版)——评测空窗期正是实测内容的窗口;
- 对 770B 的部署门槛有讨论(FP8 版是给推理服务商的信号)。
来源
- ✅ HF tencent/Hy4-preview、HF Collection、混元官网公告
- ⚠️ 橘鸦 8-29(盲测对比说法)
- ⚠️ 第三方报道:kamacoder、AIbase(仅作线索)
写作钩子
- 知识树强关联:
moe节点(探针 10 + GLM 连载 06 都讲过 MoE——「又一家 MoE 巨兽,激活率 6.4% vs GLM 的 3.5%」就是现成选题);long-context(1M 军备赛) - 实测建议:Hy4-preview vs GLM-5.3 vs Kimi K3 同题横评(官方盲测的独立复现——正是我们「我测过了」的定位);preview 阶段抢先测有时效红利
- 注意点:官方「盲测略优」无细节,引用时必须标「官方口径」