#AI
腾讯开源混元 Hy4 Preview
腾讯 8 月 28 日发布并开源混元 **Hy4 Preview**,总参数 **770B**、单 token 激活 **49B**,原生上下文窗口 1M(1,048,576 tokens)。总参数达 770B、单 token 激活 49B,原生上下文窗口 1M(1,048,576 tokens)。
激活率 6.4%(49B/770B)是理解这套模型的入口:参数总量决定显存与加载成本,激活量决定每 token 实际计算量,两者被拉开 15 倍以上。落地的算力账来自门控稀疏注意力(DSA)加 **IndexCache** 跨层索引复用,78 层里只有约 21 层独立做索引检索,其余复用相邻层结果,砍掉近四分之三索引扫描计算。
💡 为什么值得看770B 参数只激活 49B,1M 上下文靠稀疏注意力落地,Apache 2.0 商用无门槛,直接对标 GLM、Kimi。
一次必须克制的开源发布
- 盲测 2.99 仅是内部自组织评测,203 个样本、主场任务集和评委,0.05-0.07 分差统计意义有限,不能证明「全面领先」
- 1M 上下文靠 DSA(top-2048 稀疏注意力)+ IndexCache 落地,但已知问题:复杂任务思考时间偏长、过度验证,生产环境会转化为更多延迟与输出 token
- 770B 开放权重对个人开发者门槛仍高,更适合云端集群与大型企业私有化部署;Apache 2.0 无商用限制是相对 GLM/Kimi 的差异化筹码
腾讯未公布正式版 Hy4 时间表,也未说明预览版与正式版差别有多大——这版更像是一次「用内部工程、游戏、金融工作流反驯模型」的路线宣示,而非成熟交付。
查证
来源与可信度
孤证
· API 定价为输入 6 元/百万 token、输出 18 元、缓存命中 0.3 元(人民币)
[2]
延伸阅读
DSA 稀疏注意力 + IndexCache 复用索引的组合能否真正把 1M 窗口变成可用工程能力,是这版模型最有分量的技术看点
0.07 分的胜负与四成负率,加上评委/任务集的自组织属性,解释了为什幺不该把「险胜」当卖点