跳到正文
原文
Hugging Face Blog·· 2026-08-21AI 评分53

LFM2.5-DSpark 推理加速最高 3.2 倍

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI发布LFM2.5-DSpark推测解码草稿模型,为LFM2.5-1.2B-Instruct、LFM2.5-2.6B和LFM2.5-8B-A1B三款模型提供最高3.2倍GPU加速与最高2.87倍端侧加速。函数调用延迟平均降低57%,llama.cpp与SGLang已支持首日集成。

来源:Hugging Face Blog · huggingface.co