Gemini Omni 1.1 Flash: สิ่งที่เปิดตัวสำหรับควบคุมวิดีโอ
Gemini Omni 1.1 Flash ของ Google คืออัปเดตวิดีโอที่พร้อมงานโปรดักชัน ต่อฉาก กำหนดเฟรมแรกและเฟรมสุดท้าย ร่างที่ 360p แล้วสร้างเอาต์พุต 1080p หรือ 4K

วันที่ 27 สิงหาคม 2026 Google เปิดตัว Gemini Omni 1.1 Flash ซึ่งเป็นอัปเดตแรกที่เน้นงานโปรดักชันของโมเดลวิดีโอ Omni Flash ที่เปิดตัวในงาน I/O ประกาศทางการ และ เธรด X ของ Google วางตำแหน่งว่าเป็นรุ่นเรื่องการควบคุม ไม่ใช่การเปลี่ยนชื่อ คือต่อฉาก ล็อกเฟรมต้นและเฟรมจบ แนบวิดีโออ้างอิงสั้น ๆ ร่างราคาถูกที่ 360p แล้วสร้าง 1080p หรือ 4K สำหรับเทคที่คุณเก็บไว้
นั่นเป็นงานคนละแบบกับเดบิวต์ฝั่งผู้บริโภควันที่ 19 พฤษภาคม ที่เราเขียนไว้ใน Gemini Omni Flash: สิ่งที่เปิดตัวแล้วและสิ่งที่ Google ยังไม่ปล่อยออกมา ข้อเสนอเดิมของ Flash คือการแก้ไขแบบสนทนาและอินพุต any-to-any โดยคลิปยาว 10 วินาทีแบบตายตัว และ API สำหรับนักพัฒนาวันที่ 30 มิถุนายน ไม่มีการต่อฉาก 1.1 คือรอบที่พยายามทำให้คลิปเหล่านั้นยาวพอ คมพอ และกำกับได้พอสำหรับสายงานโปรดักชัน
บทความนี้สรุปความสามารถว่า 1.1 เพิ่มอะไรจริง ข้อจำกัดใดยังอยู่ และงานไหนในนั้นที่คุณรันบน OmniArt ได้แล้ววันนี้
Gemini Omni 1.1 Flash เปิดตัวอะไรจริง ๆ
API id ของ Google คือ gemini-omni-1.1-flash (พรีวิวบน Gemini Enterprise Agent Platform เป็น gemini-omni-1.1-flash-preview) เอาต์พุตเริ่มต้นยังเป็น 720p แนวนอน อัตราส่วนภาพยังมีสองแบบคือ 16:9 และ 9:16 ลายน้ำ SynthID ยังบังคับอยู่
| ความสามารถ | Omni Flash เดิม | Omni 1.1 Flash |
|---|---|---|
| ความยาวคลิป | 10 วินาทีต่อการสร้างหนึ่งครั้ง | การสร้างละ 10 วินาที ต่อเพิ่มทีละ 10 วินาที รวมได้ถึง 40 วินาที |
| การต่อฉาก | ไม่มีใน API วันที่ 30 มิถุนายน | วิเคราะห์ฟุตเทจก่อนหน้าได้ถึง 10 วินาที (ไม่ใช่แค่วินาทีสุดท้าย) |
| เฟรมแรกและเฟรมสุดท้าย | ไม่ใช่โหมด API หลัก | สอดแทรกการเคลื่อนไหวต่อเนื่องระหว่างคีย์เฟรมสองจุด |
| วิดีโออ้างอิง | หนึ่งคลิป คลิปเกิน 3 วินาทีประมวลผลไม่ครบ | ได้สูงสุด สามคลิป คลิปละ 3 วินาที |
| ความละเอียดร่าง | ค่าเริ่มต้น 720p ไม่มีระดับพรีวิวที่ถูกกว่า | ร่าง 360p Google ระบุว่าเร็วขึ้นได้ถึง 60% และราคาประมาณหนึ่งในสามของ 720p |
| ความละเอียดงานจบ | ไม่เปิดเผยที่งาน I/O OmniArt ให้ 720p | เอาต์พุต 1080p หรือ 4K เอกสารระบุว่าขยายมาจากผลงาน 720p |
| พื้นที่ใช้งาน | แอป Gemini, Flow, YouTube แล้วจึงเป็น API วันที่ 30 มิถุนายน | Google AI Studio, Gemini API, Gemini Enterprise Agent Platform, Google Flow การต่อฉากมีในแอป Gemini สำหรับ Google AI Plus Pro และ Ultra ด้วย |
รายการที่ถูกเก็บไว้ตั้งแต่งาน I/O ไม่ขยับ เอกสารปัจจุบันของ Google ยังระบุว่าไม่รองรับการแก้ไขเสียงพูด ไม่รองรับการอัปโหลดเสียงอ้างอิง และโหมดอวตารไม่เคยอยู่ในรุ่นนี้ 1.1 เพิ่มการกำกับและความยาว ไม่ได้เพิ่มฟีเจอร์ที่ถูกเก็บไว้เพราะความปลอดภัย
การต่อฉาก : อ่านบริบท 10 วินาที ยาวได้ถึง 40 วินาที
การต่อฉากคือพาดหัว คุณต่อจากท้ายคลิปที่มีอยู่ แทนการหวังว่าการสร้าง 10 วินาทีรอบใหม่จะต่อกันได้พอดี
ตัวเลขของ Google เอง ตอนนี้โมเดลอ่านฟุตเทจก่อนหน้าได้ถึง 10 วินาที ซึ่งเป็น "ก้าวกระโดดจากโมเดลก่อนหน้าที่อ้างอิงแค่วินาทีสุดท้าย" แล้วต่อท้ายอีก 3–10 วินาที ทำซ้ำทีละ 10 วินาทีจนกว่าคลิปรวมจะแตะ 40 วินาที เฟรมท้ายบางส่วนของต้นทางถูกเขียนใหม่เพื่อไม่ให้รอยต่อเป็นการตัดแบบแข็ง คุณต่อข้างหน้าไม่ได้ และต่อกลางคลิปก็ไม่ได้
พรอมต์สำหรับต่อฉากสั้นได้แค่ "Continue the scene." หรือจะระบุการเคลื่อนกล้องใหม่ก็ได้ เอกสารของ Google ระบุชัดว่า 0 วินาทีในพรอมต์ต่อฉากที่มีไทม์สแตมป์หมายถึงจุดเริ่มของช่วง ใหม่ ไม่ใช่จุดเริ่มของคลิปต้นฉบับ อธิบายเสียงถ้าต้องการให้ดนตรีประกอบเปลี่ยน มิฉะนั้นโมเดลจะพยายามรักษาให้ต่อเนื่อง
มีข้อจำกัดสองข้อที่สำคัญก่อนจะวางโครงชิ้นงาน 40 วินาทีบนฟีเจอร์นี้
- คลิปต้นทางที่อัปโหลดเพื่อต่อฉากต้องยาว ไม่เกิน 10 วินาที เว้นแต่คุณกำลังต่อคลิปที่โมเดลสร้างไว้แล้วในเซสชันหลายรอบเดียวกัน
- การต่อคลิปที่อัปโหลด ใช้ไม่ได้ใน EEA สวิตเซอร์แลนด์ หรือสหราชอาณาจักร การต่อคลิปที่โมเดลสร้างใช้ได้ในทุกภูมิภาคที่ API เปิดอยู่
บน OmniArt Seedance 2.5 รับงานใกล้เคียงนี้อยู่แล้ว คือต่อผลงานใดก็ได้ที่ยาวไม่เกิน 30 วินาที ทำซ้ำได้ถึง 60 วินาที หรือสร้าง 30–180 วินาทีในรอบ Long Video ครั้งเดียว นั่นคือเส้นทางในพื้นที่ทำงานสำหรับวิดีโอยาวที่กำกับได้ในวันนี้ โซ่ Omni พื้นเมือง 40 วินาทีของ 1.1 คือเวอร์ชันบนพื้นผิว Google ของแนวคิดเดียวกัน
เฟรมแรกและเฟรมสุดท้าย
กำหนดภาพเริ่มและภาพจบ แล้ว Omni 1.1 จะสร้างการเคลื่อนไหวต่อเนื่องระหว่างทั้งสอง Google วางตำแหน่งงานนี้สำหรับวงโคจรกล้อง การซูมเปลี่ยนผ่าน และคลิปวนลูป โดยอย่างสุดท้ายใช้ภาพเดียวกันเป็นทั้งเฟรมแรกและเฟรมสุดท้าย
แท็กในพรอมต์ผูกบทบาท Google ระบุแท็ก FIRST_FRAME และ LAST_FRAME แบบง่ายในพรอมต์ พรอมต์ที่ซับซ้อนกว่าประกาศแหล่งที่มาได้ชัดเจน
[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]
แท็กคงอยู่ในพรอมต์ตามที่เขียน ส่วนข้อความกำกับรอบข้างคือที่คุณอธิบายการเคลื่อนที่ ช็อตต่อเนื่องหนึ่งช็อต ไม่มีการตัดกระโดด กล้องทำอะไรระหว่างภาพนิ่งสองใบ
บน OmniArt PixVerse V6 เปิดขั้นตอนเปลี่ยนผ่านระหว่างเฟรมเริ่มและเฟรมจบที่อนุมัติแล้วอยู่แล้ว ถ้าบรีฟคือ "ไปจากเฟรมนี้ไปเฟรมนั้น" คุณไม่ต้องรอให้ Omni 1.1 ลงเป็นรหัสโมเดลแยก ถ้าบรีฟคือ "ทำสิ่งนั้นในเธรดสนทนาของ Omni Flash" สิ่งนั้นยังอยู่บน Interactions API ของ Google
วิดีโออ้างอิง สูงสุดคลิปละสามวินาที
1.1 ให้คุณวางวิดีโออ้างอิงสั้นลงในพรอมต์มัลติโมดัลเดียวกับข้อความและภาพ เดโมสาธารณะของ Google จับคู่คลิปนักเต้นสามคลิปกับภาพนิ่งตัวละครสามภาพ แล้วขอช็อตต่อเนื่องหนึ่งช็อต
เพดานในเอกสารเข้มกว่าประโยคการตลาด วิดีโออ้างอิงได้ผลดีที่สุดกับความคล้ายใบหน้า เสียงในคลิปอ้างอิงถูกละเลย คุณได้สูงสุด สามคลิป คลิปละไม่เกิน 3 วินาที Google ยังระบุว่าการอ้างอิงหรือให้เหตุผลข้ามวิดีโอหลายไฟล์ไม่รองรับในฐานะการเปรียบเทียบเชิงเรื่องราว ให้ถือแต่ละคลิปเป็นไฟล์อ้างอิงของตัวแบบหรือการเคลื่อนไหว ไม่ใช่แหล่งที่สองสำหรับแก้ไข
นั่นคือการขยายจริงจากพรีวิววันที่ 30 มิถุนายน ซึ่งรับวิดีโออ้างอิงได้หนึ่งคลิปและประมวลผลคลิปยาวเกิน 3 วินาทีไม่ครบ ยังไม่ใช่ครึ่งอินพุตเสียงของ ข้อเสนอ any-to-any เสียงยังเป็นสิ่งที่คุณอธิบายในพรอมต์
รายการ Gemini Omni ปัจจุบันของ OmniArt รับวิดีโออ้างอิงหนึ่งไฟล์ (MP4 หรือ MOV ความยาว 1–10 วินาที) ผสมกับภาพอ้างอิงได้สูงสุดห้าภาพ และคิดเงินตามความยาวคลิปต้นทาง ใช้แบบนั้นสำหรับไฟล์อ้างอิงการเคลื่อนไหวชิ้นเดียววันนี้ สำหรับชุดไฟล์อ้างอิงที่ใหญ่กว่า Seedance 2.5 ยังเป็นโมเดลในพื้นที่ทำงานที่สร้างมาเพื่องานนั้น
ร่าง 360p และเอาต์พุต 1080p / 4K
บันไดความละเอียดคือการเปลี่ยนแปลงฝั่งโปรดักชันอีกจุด การสร้างเริ่มต้นคือ 720p ตอนนี้คุณขอได้ดังนี้
- 360p — ระดับร่างราคาถูกของ Google อ้างว่าเร็วขึ้นได้ถึง 60% และราคาประมาณหนึ่งในสามของ 720p Flow ให้ร่างที่ 360p แล้วดาวน์โหลดเทคที่เก็บที่ 720p
- 1080p หรือ 4K — เอกสารระบุว่าเป็นเอาต์พุตที่ขยายมาจากผลงาน 720p มุ่งงานจบสำหรับโซเชียล ดิจิทัล หรือออกอากาศ
เวิร์กโฟลว์ที่ใช้ได้คือแบบตรงไปตรงมา สำรวจกล้อง การแสดง และจุดตัดที่ 360p แล้วใช้การสร้าง 1080p หรือ 4K กับเทคที่คุณจะส่งจริง นั่นคือวินัยเดียวกับการร่างบนโมเดลเร็วใน OmniArt ก่อนจบงานบนโมเดลที่แพงกว่า ต่างแค่ว่าตอนนี้เป็นการสลับความละเอียดบนโมเดล Omni ตัวเดียว
หมายเหตุ
Google เผยตารางราคา API รายความละเอียดพร้อมประกาศ 1.1 ให้ถือประโยค 360p "หนึ่งในสามของ 720p" เป็นการเปรียบเทียบของ Google เอง ไม่ใช่สูตรคิดเครดิตของ OmniArt รายการ Gemini Omni ของ OmniArt ตอนนี้คิดเงินบนพื้นผิว 720p ความยาว 3–10 วินาที
การสร้าง 4K จากต้นทางยังเป็นงานของ Veo 3.1 ในกลุ่มโมเดลนี้ เส้นทาง 4K ของ 1.1 คือขั้นงานจบบนคลิป Omni ไม่ใช่คำกล่าวว่า Omni มาแทน Veo สำหรับงานจอใหญ่
เปิดใช้ที่ไหน และ OmniArt เปิดให้อะไรวันนี้
Google กำลังทยอยเปิด 1.1 ทั้งระบบของตัวเองในวันที่ 27 สิงหาคม
- Google AI Studio และ Gemini API (
gemini-omni-1.1-flash) - Gemini Enterprise Agent Platform (
gemini-omni-1.1-flash-preview) - Google Flow รวมเฟรมเริ่ม/เฟรมจบ ร่าง 360p และการส่งออก 1080p / 4K
- การต่อฉากใน แอป Gemini สำหรับสมาชิก Google AI Plus Pro และ Ultra
การสร้าง Gemini Omni มาตรฐานมีบน OmniArt แล้ว คือ 720p ความยาว 3–10 วินาที เสียงในตัว ภาพอ้างอิงสูงสุดห้าภาพและวิดีโออ้างอิงหนึ่งไฟล์ แพ็กเกจ Starter ขึ้นไป OmniArt ยังไม่เปิดรหัสโมเดลแยก gemini-omni-1.1-flash โซ่ต่อฉาก 40 วินาที งานเฟรมแรกและเฟรมสุดท้าย หรือบันไดความละเอียด 360p / 1080p / 4K การแก้ไขแบบสนทนาที่รักษาเซสชันยังต้องใช้ Interactions API ของ Google เหมือนตอนที่เราเขียนถึง API สำหรับนักพัฒนาวันที่ 30 มิถุนายน
คำเตือน
อย่าตั้งเป้าส่งมอบคลิป Omni 1.1 ยาว 40 วินาทีจากตัวเลือก Gemini Omni ปัจจุบันของ OmniArt โมเดลที่เปิดในพื้นที่ทำงานคือพื้นผิว Omni Flash 720p ยาว 10 วินาที ใช้ API หรือ Flow ของ Google สำหรับตัวควบคุมเฉพาะของ 1.1 จนกว่าจะมีรายการโมเดลแยกเปิดที่นี่
วิธีเลือกเทียบกับ Veo 3.1 และ Seedance 2.5
1.1 ไม่ได้เลิกใช้โมเดล Google ตัวอื่น และไม่ได้ทำให้ Omni เป็นตัวเลือกวิดีโอที่กำกับได้เพียงทางบน OmniArt ให้เลือกทีละช็อต
| ช็อตต้องการ | หยิบใช้ |
|---|---|
| แก้ผ่านแชทในเธรด Omni เดียว | Gemini Omni 1.1 บน API / Flow ของ Google |
| 4K จากต้นทาง เสียงเชิงพื้นที่ งานจบระดับออกอากาศ | Veo 3.1 บน OmniArt |
| เทคเดี่ยว 30 วินาที การต่อ 60 วินาที หรือวิดีโอยาว 180 วินาที | Seedance 2.5 บน OmniArt |
| สอดแทรกเฟรมแรกถึงเฟรมสุดท้ายในพื้นที่ทำงานวันนี้ | การเปลี่ยนผ่าน PixVerse V6 หรือ Seedance 2.5 First and Last Frames |
| สร้าง Omni 720p เร็วพร้อมวิดีโออ้างอิงหนึ่งไฟล์ | Gemini Omni บน OmniArt |
| ชุดไฟล์อ้างอิงมัลติโมดัลขนาดใหญ่ | Seedance 2.5 |
รูปแบบเหมือนตอนงาน I/O รุ่น Omni ใหม่คือของที่เพิ่ม คุณเก็บโมเดลที่รับบรีฟได้อยู่แล้ว และเพิ่ม 1.1 เมื่องานนั้นคือการควบคุมแบบสนทนาของ Omni บวกงานจบที่ยาวขึ้นคมขึ้นโดยเฉพาะ
สำหรับนิสัยการเขียนพรอมต์ที่ยังใช้ได้กับจังหวะ 10 วินาทีแรก — แอ็กชันเดียวชัดเจน เขียนเสียงลงในพรอมต์ ไม่มีช่องพรอมต์เชิงลบ — ดู คู่มือพรอมต์ Omni Flash สำหรับภาษาการต่อฉากบนโมเดลในพื้นที่ทำงานที่ทำอยู่แล้ว ดู คู่มือการตัดต่อและการต่อของ Seedance 2.5
สัปดาห์นี้ควรทำอะไรบน OmniArt
ถ้าอยากลองตัว Omni เอง เปิด Gemini Omni ในพื้นที่ทำงานวิดีโอ แล้วรันพื้นผิว 10 วินาที 720p ปัจจุบัน ทั้งข้อความ ภาพอ้างอิง หรือวิดีโออ้างอิงสั้นหนึ่งไฟล์ เทียบข้าง ๆ กับ Veo 3.1 Seedance 2.5 PixVerse V6 Kling และรายการที่เหลือ ยอดเดียว ไวยากรณ์พรอมต์เดียว
ถ้าบรีฟคือตัวควบคุมใหม่ของ 1.1 โดยเฉพาะ — การต่อแบบ Omni พื้นเมือง 40 วินาที การสอดแทรกเฟรมแรก/เฟรมสุดท้ายใน Omni หรือลูป 360p แล้ว 4K — สัปดาห์นี้ใช้ Google AI Studio, Flow หรือ Gemini API และให้ OmniArt เป็นที่ที่คุณสร้างส่วนที่เหลือของโปรเจกต์อยู่แล้ว
การแยกนี้ชั่วคราวในแบบเดียวกับช่องว่าง API ของ Flash เดิม เมื่อตัวควบคุมของ 1.1 ลงเป็นโมเดลที่เลือกได้บน OmniArt มันจะกลายเป็นอีกตัวเลือกในพื้นที่ทำงานที่กำลังสร้างงานอยู่แล้ว ไม่ใช่เหตุผลให้รอ
คำถามที่พบบ่อย
Gemini Omni 1.1 Flash คืออะไร?
Gemini Omni 1.1 Flash คืออัปเดตวันที่ 27 สิงหาคม 2026 ของ Google สำหรับ Omni Flash ซึ่งเป็นโมเดลสร้างและแก้ไขวิดีโอแบบมัลติโมดัล โดยเพิ่มการต่อฉาก การสอดแทรกเฟรมแรกและเฟรมสุดท้าย วิดีโออ้างอิงสั้น ร่าง 360p และเอาต์พุต 1080p / 4K ทับบนการแก้ไขแบบสนทนาเดิมกับอินพุตข้อความ ภาพ และวิดีโอ
Gemini Omni 1.1 Flash ใช้บน OmniArt ได้หรือยัง?
ยังไม่เป็นรหัสโมเดลแยก OmniArt ตอนนี้ให้ การสร้าง Gemini Omni มาตรฐาน ที่ 720p ความยาว 3–10 วินาที ตัวควบคุมเฉพาะของ 1.1 ได้แก่ การต่อ 40 วินาที เฟรมแรก/เฟรมสุดท้าย ร่าง 360p และเอาต์พุต 1080p / 4K กำลังเปิดบน Google AI Studio, Flow, Gemini API และ Gemini Enterprise Agent Platform
วิดีโอ Omni 1.1 Flash ยาวได้แค่ไหน?
การสร้างหนึ่งครั้งยังเป็นคลิป 10 วินาที การต่อฉากต่อท้ายทีละ 3–10 วินาที โดยใช้ฟุตเทจก่อนหน้าได้ถึง 10 วินาทีเป็นบริบท รวมสูงสุด 40 วินาที ต้นทางที่อัปโหลดเพื่อต่อฉากต้องยาวไม่เกิน 10 วินาที
Omni 1.1 Flash สร้าง 4K จากต้นทางได้หรือไม่?
เอกสารของ Google ระบุว่า 1080p และ 4K เป็นเอาต์พุตที่ขยายมาจากผลงาน 720p ค่าเริ่มต้น ไม่ใช่เส้นทางถ่าย 4K จากต้นทาง สำหรับวิดีโอ 4K จากต้นทางบน OmniArt Veo 3.1 ยังเป็นโมเดลสาย Google ที่สร้างมาสำหรับงานจบนั้น
เวอร์ชัน 1.1 เพิ่มการอัปโหลดเสียงอ้างอิงหรือการแก้ไขเสียงพูดหรือยัง?
ยังไม่มี เอกสาร Omni ปัจจุบันของ Google ยังระบุว่าการอัปโหลดเสียงอ้างอิงและการแก้ไขเสียงพูดไม่รองรับ เสียงในวิดีโออ้างอิงถูกละเลย เสียงยังถูกกำกับในพรอมต์ ซึ่งตรงกับสิ่งที่เราบันทึกใน บทความอินพุต any-to-any
พร้อมสร้างหรือยัง?
เริ่มสร้างคอนเทนต์ที่ยอดเยี่ยมด้วย AI