Liquid AI lança o LFM2.5-DSpark e acelera modelos em até 3,2 vezes
A Liquid AI lança a família de modelos preliminares LFM2.5-DSpark, aumentando a velocidade de inferência em até 3,2 vezes sem perda de qualidade.
A Liquid AI anunciou o LFM2.5-DSpark, um conjunto de modelos "Drafter" (modelos preliminares) para uso em conjunto com a técnica de Speculative Decoding (decodificação especulativa), projetado para aumentar a velocidade de processamento ou inferência dos modelos de inteligência artificial da família LFM2.5, mantendo a qualidade original dos resultados.
De acordo com os dados divulgados, o LFM2.5-DSpark pode aumentar a velocidade de inferência em até cerca de 3,2 vezes (com um valor específico de 3,18x), oferecendo suporte tanto para GPUs de alta performance em data centers (como a H100) quanto para dispositivos portáteis, a exemplo dos computadores MacBook.
Neste lançamento, a desenvolvedora disponibilizou simultaneamente três modelos para atender aos modelos principais da família: LFM2.5-1.2B-Instruct, LFM2.5-2.6B e LFM2.5-8B-A1B. Além disso, a ferramenta foi projetada para integração perfeita com frameworks populares de execução de grandes modelos de linguagem (LLMs), como SGLang e llama.cpp.
Permite que desenvolvedores e usuários executem os modelos da família LFM2.5 de forma visivelmente mais rápida, tanto em hardware de ponta quanto em dispositivos comuns, reduzindo o tempo e os custos de processamento de IA.