Google เปิดตัว Gemini Omni 1.1 Flash สร้างวิดีโอร่าง 360p ต้นทุนเหลือราวหนึ่งในสาม
โมเดลวิดีโอรุ่นใหม่ของ Google สร้างและแก้ไขคลิปจากข้อความ ภาพ หรือวิดีโออ้างอิง พร้อมโหมดร่าง 360p สำหรับทดลองงานในต้นทุนที่ต่ำลง
Google เปิดตัว Gemini Omni 1.1 Flash อย่างเป็นทางการเมื่อวันที่ 27 สิงหาคม 2026 โดยปรับปรุงทั้งคุณภาพและความเร็วสำหรับงาน Generative Video (การสร้างวิดีโอด้วย AI) รวมถึงการแก้ไขวิดีโอผ่านการสนทนา
โมเดลนี้เป็นระบบแบบ multimodal (รับข้อมูลหลายรูปแบบ) ผู้ใช้จึงสั่งงานด้วยข้อความ รูปภาพ หรือวิดีโออ้างอิงได้ แล้วให้โมเดลสร้างหรือแก้ไขผลลัพธ์เป็นวิดีโอ จุดที่ Google เน้นในรุ่น 1.1 Flash คือความเข้าใจ context (บริบท) จากวิดีโอก่อนหน้า เพื่อช่วยให้การสร้างฉากต่อเนื่องรักษาตัวละคร รูปลักษณ์ และองค์ประกอบต่างๆ ให้สม่ำเสมอขึ้น
Gemini Omni 1.1 Flash สามารถขยายวิดีโอให้มีความยาวรวมได้สูงสุด 40 วินาที และเพิ่ม First/Last Frame Control (การควบคุมเฟรมแรกและเฟรมสุดท้าย) ผู้สร้างจึงกำหนดจุดเริ่มต้นกับปลายทางของฉากได้ชัดขึ้น เช่น ใช้ควบคุมทิศทางกล้อง การเคลื่อนไหว หรือการเปลี่ยนผ่านระหว่างสองภาพ
ด้านความละเอียด โมเดลรองรับผลลัพธ์ตั้งแต่ 360p จนถึง 4K ฟีเจอร์ที่มีผลต่อต้นทุนโดยตรงคือ 360p draft (โหมดร่างความละเอียด 360p) ซึ่งออกแบบมาสำหรับทดลองคำสั่งและปรับแนวทางของคลิปก่อนสร้างไฟล์ความละเอียดสูง ต้นทางระบุว่าต้นทุนของโหมดนี้อยู่ที่ราวหนึ่งในสามของการสร้างด้วยความละเอียดสูงอย่าง 720p ช่วยให้ผู้ใช้ทดลองหลายรอบได้โดยไม่ต้องจ่ายราคาเต็มทุกครั้ง
Google วาง Gemini Omni เป็นโมเดลวิดีโอระดับสูงที่เน้นการควบคุมและการทำงานกับข้อมูลหลายรูปแบบ ส่วน Veo ถูกวางไว้กับงานที่ให้ความสำคัญกับต้นทุนมากกว่า การเพิ่มโหมดร่างจึงช่วยลดช่องว่างระหว่างการทดลองราคาประหยัดกับการผลิตวิดีโอคุณภาพสูง อย่างไรก็ตาม คุณภาพจริง ความสม่ำเสมอของคลิป และต้นทุนรวมยังขึ้นอยู่กับจำนวนรอบที่ผู้ใช้ต้องแก้ไขงาน
โหมดร่างราคาต่ำช่วยให้นักสร้างสรรค์และธุรกิจไทยทดลองวิดีโอ AI ได้หลายแบบก่อนจ่ายเงินสร้างไฟล์ความละเอียดสูง แต่ควรประเมินต้นทุนจากจำนวนครั้งที่ต้องสร้างใหม่ ไม่ใช่ดูเฉพาะราคาต่อคลิป