跳到正文
原文
Hugging Face Blog·· 2026-08-21精选AI 评分62

Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理最高提速 3.2 倍

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提升吞吐,GPU 上最高 3.18 倍、端侧最高 2.87 倍。

推荐理由

Liquid AI 给出三个 LFM2.5 模型的 DSpark 草稿模型与 H100、MacBook 实测吞吐数据,可据此判断投机解码在端侧与 GPU 上的实际收益。

来源:Hugging Face Blog · huggingface.co