探所 Curio 再探再报 了解探所 →
#AI

腾讯开源混元 Hy4 Preview

腾讯 8 月 28 日发布并开源混元 **Hy4 Preview**,总参数 **770B**、单 token 激活 **49B**,原生上下文窗口 1M(1,048,576 tokens)。总参数达 770B、单 token 激活 49B,原生上下文窗口 1M(1,048,576 tokens)。

激活率 6.4%(49B/770B)是理解这套模型的入口:参数总量决定显存与加载成本,激活量决定每 token 实际计算量,两者被拉开 15 倍以上。落地的算力账来自门控稀疏注意力(DSA)加 **IndexCache** 跨层索引复用,78 层里只有约 21 层独立做索引检索,其余复用相邻层结果,砍掉近四分之三索引扫描计算。

💡 为什么值得看770B 参数只激活 49B,1M 上下文靠稀疏注意力落地,Apache 2.0 商用无门槛,直接对标 GLM、Kimi。

一次必须克制的开源发布

  • 盲测 2.99 仅是内部自组织评测,203 个样本、主场任务集和评委,0.05-0.07 分差统计意义有限,不能证明「全面领先」
  • 1M 上下文靠 DSA(top-2048 稀疏注意力)+ IndexCache 落地,但已知问题:复杂任务思考时间偏长、过度验证,生产环境会转化为更多延迟与输出 token
  • 770B 开放权重对个人开发者门槛仍高,更适合云端集群与大型企业私有化部署;Apache 2.0 无商用限制是相对 GLM/Kimi 的差异化筹码

腾讯未公布正式版 Hy4 时间表,也未说明预览版与正式版差别有多大——这版更像是一次「用内部工程、游戏、金融工作流反驯模型」的路线宣示,而非成熟交付。

查证

来源与可信度

· 腾讯 8 月 28 日发布并开源混元 Hy4 Preview,总参数 770B、单 token 激活 49B、上下文窗口 1M [1][2]
· 权重以 Apache 2.0 协议开源,上传至 Hugging Face、ModelScope、GitCode 等平台 [1][2]
· 模型为 78 层高稀疏 MoE,仅首层为稠密 FFN,其余 77 层各配 256 个路由专家,每 token 激活 8 个 [1][2]
孤证 · API 定价为输入 6 元/百万 token、输出 18 元、缓存命中 0.3 元(人民币) [2]

延伸阅读

1M 上下文如何便宜落地 · view.inews.qq.com 8 分钟
DSA 稀疏注意力 + IndexCache 复用索引的组合能否真正把 1M 窗口变成可用工程能力,是这版模型最有分量的技术看点
盲测评分的克制解读 · news.cocoloop.cn 5 分钟
0.07 分的胜负与四成负率,加上评委/任务集的自组织属性,解释了为什幺不该把「险胜」当卖点
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store