Liquid AI Meluncurkan LFM2.5-DSpark, Tingkatkan Kecepatan Model hingga 3,2 Kali Lipat
Liquid AI merilis rangkaian model drafter LFM2.5-DSpark, meningkatkan kecepatan inferensi hingga 3,2 kali lipat tanpa mengorbankan kualitas.
Liquid AI telah mengumumkan peluncuran LFM2.5-DSpark, rangkaian model "drafter" yang digunakan bersama dengan teknik Speculative Decoding untuk membantu meningkatkan kecepatan pemrosesan atau inferensi dari model kecerdasan buatan dalam keluarga LFM2.5, dengan tetap mempertahankan kualitas hasil yang sama.
Berdasarkan data yang diungkapkan, LFM2.5-DSpark dapat meningkatkan kecepatan inferensi hingga sekitar 3,2 kali lipat (angka pasti 3,18 kali lipat), yang mendukung pengoperasian baik pada GPU berkinerja tinggi untuk pusat data (seperti H100) maupun perangkat portabel seperti komputer MacBook.
Dalam peluncuran ini, pengembang telah merilis 3 model secara bersamaan untuk mendukung model utama dalam keluarga tersebut, yaitu LFM2.5-1.2B-Instruct, LFM2.5-2.6B, dan LFM2.5-8B-A1B. Selain itu, alat ini telah dirancang agar dapat terintegrasi dengan baik dengan kerangka kerja populer untuk menjalankan model bahasa besar (LLM) seperti SGLang dan llama.cpp.
Memungkinkan pengembang dan pengguna untuk menjalankan model keluarga LFM2.5 secara jauh lebih cepat, baik pada perangkat keras tingkat tinggi maupun perangkat umum, sehingga membantu mengurangi waktu dan biaya pemrosesan AI.