Liquid AI lance LFM2.5-DSpark et accélère ses modèles jusqu'à 3,2 fois
Liquid AI dévoile la suite de modèles brouillons LFM2.5-DSpark, augmentant la vitesse d'inférence jusqu'à 3,2 fois sans perte de qualité.
Liquid AI a annoncé le lancement de LFM2.5-DSpark, une suite de modèles « Drafter » (modèles brouillons) conçue pour être utilisée avec la technique de décodage spéculatif (Speculative Decoding). Elle permet d'accélérer le traitement et l'inférence des modèles d'intelligence artificielle de la famille LFM2.5 tout en préservant la qualité des résultats.
Selon les données publiées, LFM2.5-DSpark peut multiplier la vitesse d'inférence par environ 3,2 (précisément 3,18 fois), prenant en charge aussi bien les cartes graphiques haute performance pour centres de données telles que les GPU (comme le H100) que les appareils portables comme les ordinateurs MacBook.
À l'occasion de ce lancement, les développeurs ont publié trois versions pour prendre en charge les modèles principaux de la famille : LFM2.5-1.2B-Instruct, LFM2.5-2.6B et LFM2.5-8B-A1B. De plus, l'outil a été conçu pour s'intégrer parfaitement aux frameworks populaires d'exécution de grands modèles de langage (LLM) tels que SGLang et llama.cpp.
Permet aux développeurs et aux utilisateurs d'exécuter les modèles de la famille LFM2.5 beaucoup plus rapidement, tant sur du matériel haut de gamme que sur des appareils grand public, réduisant ainsi le temps et les coûts de traitement de l'IA.