跳到正文
原文
Hugging Face Blog·· 2026-08-21精选AI 评分62

Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理速度最高提升 3.18 倍

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 发布 LFM2.5 系列三款模型的 DSpark 草稿模型检查点,通过投机解码在 GPU 上实现最高 3.18 倍吞吐提升,端侧最高 2.87 倍,且不改变输出质量。LFM2.5-2.6B 的函数调用延迟平均降低 57%,并已开源支持 llama.cpp 和 SGLang。

推荐理由

原文给出了三款草稿模型的加速数据和接入方式,读者可据此评估投机解码带来的实际收益。

来源:Hugging Face Blog · huggingface.co