跳到正文
原文
Hugging Face:Blog(RSS)·· 2026-08-21精选AI 评分66

Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理最高提速 3.2 倍

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,采用推测解码,GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍,输出质量不变。

推荐理由

原文给出各模型在 GPU 和端侧的实测加速数据与 llama.cpp、SGLang 接入命令,读者可直接评估是否用于部署。

来源:Hugging Face:Blog(RSS) · huggingface.co