← バックナンバーINFERENCEHugging Face
Liquid AI、LFM2.5向けDSparkで推論高速化を公開
Liquid AIはHugging Faceで、LFM2.5-1.2B-Instruct、LFM2.5-2.6B、LFM2.5-8B-A1B向けDSpark draft model checkpointsを公開しました。speculative decodingにより、H100で最大3.18倍、on-deviceで最大2.87倍のthroughput改善を示しています。
公式発表を読む