
2026年8月21日,Liquid AI与Hugging Face联合发布LFM2.5系列DSpark草稿模型检查点,覆盖1.2B、2.6B、8B-A1B三款参数规格。该模型采用全新投机解码路径,在完全不改变输出质量的前提下大幅提升推理吞吐量,GPU端实测最高提速3.18倍,端侧设备最高提速2.87倍,有效降低端侧智能体应用运行门槛。

在搭载M4Max芯片的MacBook Pro上,运行LFM2.5-2.6B版本DSpark模型的输出速度最高可达每秒139个token,这一数字比此前的常规版本提升了近2倍,而用户拿到的生成内容质量没有出现任何衰减。这也是此次新模型最核心的差异化优势:在不牺牲效果的前提下实现效率翻倍。
此次发布的DSpark草稿模型,核心优化逻辑是新增了投机解码路径,没有改动LFM2.5系列模型的预训练参数和生成逻辑,因此能做到完全不改变输出质量,和原版本模型的生成结果完全一致,解决了过往提速方案往往要牺牲生成效果的普遍痛点。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录