Liquid AI เปิดตัว LFM2.5-DSpark เร่งความเร็วโมเดลพุ่งสูงสุด 3.2 เท่า
Liquid AI ปล่อยชุดโมเดลร่าง LFM2.5-DSpark ช่วยเพิ่มความเร็วการอนุมานสูงสุด 3.2 เท่าโดยไม่ลดทอนคุณภาพ
Liquid AI ได้ประกาศเปิดตัว LFM2.5-DSpark ซึ่งเป็นชุดโมเดล "Drafter" (โมเดลร่าง) สำหรับใช้ร่วมกับเทคนิค Speculative Decoding (การถอดรหัสแบบคาดการณ์ล่วงหน้า) เพื่อช่วยเพิ่มความเร็วในการประมวลผลหรือ Inference ของโมเดลปัญญาประดิษฐ์ในตระกูล LFM2.5 โดยยังคงรักษาคุณภาพของผลลัพธ์เอาไว้ได้ตามเดิม
จากการเปิดเผยข้อมูลระบุว่า LFM2.5-DSpark สามารถเพิ่มความเร็วในการอนุมานได้สูงสุดประมาณ 3.2 เท่า (ตัวเลขเจาะจงที่ 3.18 เท่า) ซึ่งรองรับการทำงานทั้งบนการ์ดจอประสิทธิภาพสูงสำหรับศูนย์ข้อมูลอย่าง GPU (เช่น H100) และอุปกรณ์พกพาอย่างเช่นคอมพิวเตอร์ MacBook
ในการเปิดตัวครั้งนี้ ทางผู้พัฒนาได้ปล่อยโมเดลออกมาพร้อมกัน 3 รุ่น เพื่อรองรับโมเดลหลักในตระกูล ได้แก่ LFM2.5-1.2B-Instruct, LFM2.5-2.6B และ LFM2.5-8B-A1B นอกจากนี้ ตัวเครื่องมือยังได้รับการออกแบบมาให้สามารถใช้งานร่วมกับเฟรมเวิร์กยอดนิยมสำหรับการรันโมเดลภาษาขนาดใหญ่อย่าง SGLang และ llama.cpp ได้เป็นอย่างดี
ช่วยให้ผู้พัฒนาและผู้ใช้งานสามารถรันโมเดลตระกูล LFM2.5 ได้รวดเร็วยิ่งขึ้นอย่างเห็นได้ชัด ทั้งบนฮาร์ดแวร์ระดับสูงและอุปกรณ์ทั่วไป ช่วยลดเวลาและต้นทุนในการประมวลผล AI ลงได้