Hugging Face Blog·· 2026-08-21AI 评分53
LFM2.5-DSpark 推理加速最高 3.2 倍
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI发布LFM2.5-DSpark推测解码草稿模型,为LFM2.5-1.2B-Instruct、LFM2.5-2.6B和LFM2.5-8B-A1B三款模型提供最高3.2倍GPU加速与最高2.87倍端侧加速。函数调用延迟平均降低57%,llama.cpp与SGLang已支持首日集成。
来源:Hugging Face Blog · huggingface.co