跳到正文
原文
Hugging Face Blog·· 2026-08-21精选AI 评分69

Liquid AI 发布 LFM2.5-DSpark 草稿模型,H100 最高提速 3.2 倍

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 发布 LFM2.5-DSpark 草稿模型,覆盖 LFM2.5-1.2B-Instruct、2.6B 与 8B-A1B,H100 上最高获得 3.2 倍吞吐提升,2.6B 端侧函数调用延迟平均下降 57%,输出在贪心解码下与目标模型一致,并提供 SGLang 与 llama.cpp 的一键启动方式。

推荐理由

本文给出了 DSpark 在 H100 与 M4 Max 上的具体吞吐提升与接受率数据,并提供了 SGLang、llama.cpp 的一键启动命令。

来源:Hugging Face Blog · huggingface.co