AI & MACHINE LEARNING

เจาะลึกการใช้ Gemini Omni ในการสร้างและตัดต่อวิดีโอระดับสูง

Google Blog07 Aug 2026
1 min read
Key Takeaways
  • Gemini Omni ช่วยให้นักพัฒนาสร้างและตัดต่อวิดีโอที่ซับซ้อนได้ง่ายผ่านการสั่งงานด้วยภาษาธรรมชาติและภาพร่าง

ทำไมเรื่องนี้ถึงสำคัญ

Gemini Omni กำลังลดช่องว่างระหว่างความคิดสร้างสรรค์กับทักษะทางเทคนิคในการผลิตวิดีโอ ซึ่งอาจเปลี่ยนวิธีการทำงานของอุตสาหกรรม Creative Content

หลังจากที่เปิดให้นักพัฒนาเข้าใช้งาน Gemini Omni Flash ไปเมื่อเร็วๆ นี้ Google ได้นำเสนอตัวอย่างผลงานที่โดดเด่น ซึ่งแสดงให้เห็นว่าโมเดลรุ่นใหม่นี้สามารถทำให้การตัดต่อวิดีโอทำได้ง่ายเพียงแค่การสั่งงานด้วยเสียงหรือข้อความ โดย Gemini Omni มีความเข้าใจในหลักฟิสิกส์และความรู้รอบตัว ทำให้ผลลัพธ์ที่ได้มีความสมจริงและไหลลื่น

ตัวอย่างที่น่าสนใจรวมถึงการเปลี่ยนมุมกล้องรอบวัตถุในวิดีโอได้ถึง 20 มุมมองโดยยังคงความต่อเนื่องของฉาก การเปลี่ยนสภาพแวดล้อมจากกลางวันเป็นกลางคืนด้วยเสียงสั่งงาน และฟีเจอร์ที่ทำงานร่วมกับ Google Flow เพื่อเปลี่ยนภาพสเก็ตช์ธรรมดาให้กลายเป็นวิดีโอแอนิเมชัน เช่น การเปลี่ยนเลมอนให้กลายเป็นเรือดำน้ำ หรือการเปลี่ยนกรรไกรให้เป็นฉลาม ซึ่งเป็นการพิสูจน์ศักยภาพของโมเดลในการตีความเชิงสร้างสรรค์ระดับสูง

สรุปประเด็นหลัก

รองรับการเปลี่ยนมุมกล้องและ Perspective ของวิดีโอได้อย่างแนบเนียน

สามารถเปลี่ยนสไตล์วิดีโอ เช่น จากคนจริงเป็นอนิเมะหรือ Claymation โดยไม่เสียความต่อเนื่อง

ฟีเจอร์ Sketch-to-Video ช่วยแปลงลายเส้นให้กลายเป็นวัตถุเคลื่อนไหวที่สอดคล้องกับฟิสิกส์

นวัตกรรมและเทคโนโลยี

creative ai

Gemini Omni Video Editing

ความสามารถในการแก้ไขมุมกล้อง แสงสี และสภาพแวดล้อมในวิดีโอผ่านคำสั่งภาษาธรรมชาติ

models

Multimodal Animation

การใช้ภาพร่างและข้อความเพื่อไกด์การสร้างแอนิเมชันที่เข้าใจกฎฟิสิกส์โลกจริง

Developer Impact
นักพัฒนาด้านสื่อและแอปพลิเคชันสร้างสรรค์สามารถใช้ Gemini API เพื่อเพิ่มฟีเจอร์ตัดต่อวิดีโอขั้นสูงที่ทำงานได้รวดเร็วและใช้ต้นทุนต่ำลง
Keywords
#gemini omni #video generation #google flow #multimodal ai
Original Source

อ่านข้อมูลเพิ่มเติมจากแหล่งข่าวหลัก

Google Blog