探所 Curio 再探再报 了解探所 →
#AI

Liquid AI 发布 LFM2.5-DSpark 草稿模型

Liquid AI 今天发布 LFM2.5 家族三款模型的 **DSpark 草稿模型 checkpoint**:LFM2.5-1.2B-Instruct、LFM2.5-2.6B、LFM2.5-8B-A1B。

这是官方采用的推测解码(speculative decoding)路线,用约 300M 参数的轻量草稿模型预生成候选 token,再由目标模型一次性验证,牺牲少量显存换取大幅解码提速,且 greedy 解码下输出与基线完全一致。

💡 为什么值得看H100 提速 3.18 倍,端侧 2.87 倍,延迟降 57%,影响推理性能。

查证

来源档案

Liquid AI 官方博客

官方一手公告(HuggingFace 上刊发的技术博客),含实测数据、架构说明、使用命令与模型下载链接

可信度高,数字为官方自测;benchmark 为 greedy、batch=1、temperature=0 的理想条件下测得,实际负载提升会打折

延伸阅读

DSpark 架构细节 · huggingface.co 约 8 分钟
DFlash 并行骨干 + Markov 顺序头 + 置信度调度验证器三组件如何组合,想深入推测解码设计思路的可看
端侧 MoE 瓶颈 · huggingface.co 约 4 分钟
官方明确承认 8B-A1B 端侧只涨 18%,归因 Metal 后端 MoE 实现,对关心 on-device agentic 推理的人是最有价值的信号
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store