Google เปิดตัว Gemini Omni 1.1 Flash สำหรับสร้างและแก้ไขวิดีโอ
โมเดลใหม่รองรับข้อความ ภาพ เสียง และวิดีโอ พร้อมควบคุมจุดเริ่มต้น จุดสิ้นสุด และขยายฉากเดิมได้
Google เปิดตัว Gemini Omni 1.1 Flash อย่างเป็นทางการเมื่อวันที่ 27 สิงหาคม 2026 ในสถานะพร้อมใช้งานทั่วไป โดยวางให้เป็นโมเดล Multimodal (รองรับข้อมูลหลายรูปแบบ) สำหรับงาน Generative Video (การสร้างวิดีโอด้วย AI) และการแก้ไขวิดีโอ
จุดเด่นคือ Scene Extension (การขยายฉากวิดีโอ) ซึ่งวิเคราะห์บริบทจากวิดีโอย้อนหลังได้สูงสุด 10 วินาที ก่อนสร้างภาพต่อจากเนื้อหาเดิม ความสามารถนี้ช่วยให้การต่อฉากรักษาบรรยากาศและองค์ประกอบจากช่วงก่อนหน้าได้ดีขึ้น โดยผู้ใช้ยังควบคุมเฟรมเริ่มต้นและเฟรมสุดท้าย เพื่อกำหนดทิศทางและความต่อเนื่องของการเปลี่ยนผ่านได้
โมเดลรองรับวิดีโอความละเอียดสูงสุด 4K ขณะเดียวกันมีโหมด Draft (ร่างวิดีโอ) ที่ความละเอียด 360p สำหรับทดลองแนวคิดก่อนสร้างไฟล์คุณภาพสูง ช่วยลดต้นทุนในช่วงปรับแก้และทดสอบคำสั่ง อินพุตที่รองรับครอบคลุมข้อความ รูปภาพ เสียง และวิดีโอ จึงสามารถใช้ข้อมูลหลายชนิดประกอบกันในการกำหนดผลงาน
Gemini Omni 1.1 Flash เปิดให้เข้าถึงผ่าน Google AI Studio, Gemini Enterprise Agent Platform และ Google Flow การเปิดตัวครั้งนี้สะท้อนว่าเครื่องมือวิดีโอด้วย AI กำลังขยับจากการสร้างคลิปตามข้อความ ไปสู่การควบคุมลำดับภาพและแก้ไขเนื้อหาที่มีอยู่ได้ละเอียดขึ้น อย่างไรก็ตาม คุณภาพจริงยังขึ้นอยู่กับลักษณะวิดีโอ คำสั่ง และขั้นตอนการตรวจแก้ของผู้ใช้
นักพัฒนาและผู้ผลิตสื่อไทยมีทางเลือกเพิ่มสำหรับทำต้นแบบ ต่อยอดฉาก และวางจังหวะวิดีโอด้วย AI โดยโหมด 360p ช่วยให้ทดลองงานก่อนสร้างไฟล์ 4K ที่ใช้ทรัพยากรมากกว่า