Hugging Face Blog·· 2026-08-21精选AI 评分65
Liquid AI 发布 LFM2.5-DSpark 草稿模型实现最高 3.2x 推理加速
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI 发布 LFM2.5 系列的 DSpark 草稿模型检查点,通过推测解码技术在不改变输出质量的前提下显著提升推理速度。该方案在 H100 GPU 上最高实现 3.18x 吞吐提升,在 M4 Max MacBook Pro 端侧最高实现 2.87x 加速,并将 LFM2.5-2.6B 的函数调用延迟平均降低 57%。
推荐理由
原文提供了DSpark草稿模型在GPU和端侧设备上的具体加速数据及开源集成方案,读者可据此评估其对本地化智能体推理效率的实际提升。
来源:Hugging Face Blog · huggingface.co