LFM2.5-DSpark : jusqu’à 3,2x plus rapide avec le décodage spéculatif
Liquid AI publie des modèles brouillons DSpark pour LFM2.5. Le décodage spéculatif accélère l’inférence jusqu’à 3,18x sur H100, tout en conservant exactement la sortie greedy du modèle cible.
·
7 min