Hugging Face:Blog(RSS)·· 2026-08-21精选AI 评分66
Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理最高提速 3.2 倍
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,采用推测解码,GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍,输出质量不变。
推荐理由
原文给出各模型在 GPU 和端侧的实测加速数据与 llama.cpp、SGLang 接入命令,读者可直接评估是否用于部署。
来源:Hugging Face:Blog(RSS) · huggingface.co