Hugging Face Blog·· 2026-08-21精选AI 评分75
Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理速度最高提升 3.2 倍
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI 发布 LFM2.5-DSpark 草稿模型,为 LFM2.5 系列模型提供推测解码路径,在 H100 上最高实现 3.18 倍吞吐提升,在 M4 Max 上最高实现 2.87 倍提升。该方案已开源并支持 llama.cpp 和 SGLang,在保持输出质量不变的前提下显著降低延迟。
推荐理由
原文给出了具体加速数据与部署配置,读者可据此评估端侧交互体验提升与现有工作流的适配度。
来源:Hugging Face Blog · huggingface.co