Liquid AI presenta LFM2.5-DSpark y acelera los modelos hasta 3.2 veces
Liquid AI lanza la familia de modelos LFM2.5-DSpark, que incrementa la velocidad de inferencia hasta 3.2 veces sin sacrificar calidad.
Liquid AI ha anunciado el lanzamiento de LFM2.5-DSpark, un conjunto de modelos "drafter" (modelos borrador) diseñados para utilizarse con la técnica de Speculative Decoding (decodificación especulativa), con el fin de acelerar el procesamiento o la inferencia de los modelos de inteligencia artificial de la familia LFM2.5 manteniendo la misma calidad en los resultados.
Según la información revelada, LFM2.5-DSpark puede aumentar la velocidad de inferencia hasta aproximadamente 3.2 veces (con una cifra específica de 3.18x), admitiendo su funcionamiento tanto en tarjetas gráficas de alto rendimiento para centros de datos como GPU (por ejemplo, H100) como en dispositivos portátiles como las computadoras MacBook.
En este lanzamiento, los desarrolladores han publicado simultáneamente tres versiones de modelos para dar soporte a los modelos principales de la familia: LFM2.5-1.2B-Instruct, LFM2.5-2.6B y LFM2.5-8B-A1B. Además, la herramienta ha sido diseñada para integrarse perfectamente con frameworks populares para la ejecución de modelos de lenguaje grandes (LLM) como SGLang y llama.cpp.
Permite a desarrolladores y usuarios ejecutar los modelos de la familia LFM2.5 con una velocidad significativamente mayor, tanto en hardware de alta gama como en dispositivos convencionales, reduciendo el tiempo y los costos de procesamiento de IA.