Hugging Face Blog·· 2026-08-21精选AI 评分62
Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理最高提速 3.2 倍
Up to 3.2x Faster Inference with LFM2.5-DSpark
AI 导读
Liquid AI 为 LFM2.5 家族的 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提速,GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍。
推荐理由
原文给出三个模型的草稿检查点、H100 与 M4 Max 上的实测吞吐和 llama.cpp、SGLang 接入方式,可据此判断端侧推理的提速空间。
来源:Hugging Face Blog · huggingface.co