#AI
Liquid AI 发布 LFM2.5-DSpark 草稿模型
Liquid AI 今天发布 LFM2.5 家族三款模型的 **DSpark 草稿模型 checkpoint**:LFM2.5-1.2B-Instruct、LFM2.5-2.6B、LFM2.5-8B-A1B。
这是官方采用的推测解码(speculative decoding)路线,用约 300M 参数的轻量草稿模型预生成候选 token,再由目标模型一次性验证,牺牲少量显存换取大幅解码提速,且 greedy 解码下输出与基线完全一致。
💡 为什么值得看H100 提速 3.18 倍,端侧 2.87 倍,延迟降 57%,影响推理性能。
查证
来源档案
Liquid AI 官方博客
官方一手公告(HuggingFace 上刊发的技术博客),含实测数据、架构说明、使用命令与模型下载链接
可信度高,数字为官方自测;benchmark 为 greedy、batch=1、temperature=0 的理想条件下测得,实际负载提升会打折
延伸阅读
DFlash 并行骨干 + Markov 顺序头 + 置信度调度验证器三组件如何组合,想深入推测解码设计思路的可看
官方明确承认 8B-A1B 端侧只涨 18%,归因 Metal 后端 MoE 实现,对关心 on-device agentic 推理的人是最有价值的信号