โมเดล · Google Gemini Omni Flash

Gemini Omni Flash — วิดีโอ AI พร้อมเสียง ในราคาเดียว $1.00 ต่อคลิป

โมเดลระดับโลกของ Google สำหรับวิดีโอสั้น: ทุกคลิปมาพร้อม เสียงที่ซิงค์กัน การเคลื่อนไหวที่รับรู้หลักฟิสิกส์ และ การแก้ไขแบบสนทนา — เพียงอธิบายการเปลี่ยนแปลง ฉากก็จะถูกสร้างขึ้นใหม่ ความยาว 3–10 วินาที, 720p, อัตราส่วน 16:9 หรือแนวตั้ง 9:16 สำหรับ Shorts และ Reels ราคาเดียว $1.00 ต่อการสร้างหนึ่งครั้ง ชำระด้วยคริปโต ไม่มีการสมัครสมาชิก

คลิป Gemini Omni Flash จริงที่สร้างขึ้นบน BananaBanana — ด้วยข้อความพรอมต์เดียว, ความยาว 10 วินาที (โมเดลเลือกความยาวให้), 720p, สร้างเสียงพร้อมกันในขั้นตอนเดียว ราคาเดียว $1.00 กดเล่นพร้อมเปิดเสียงได้เลย
01คืออะไร

Gemini Omni Flash คืออะไร?

Gemini Omni Flash คือโมเดลแรกในตระกูล Gemini Omni ของ Google — ซึ่งเป็นโมเดลระดับโลกที่ใช้หลักการคิดวิเคราะห์ฉากแบบเดียวกับเอนจินฟิสิกส์ แล้วนำมาเรนเดอร์เป็นวิดีโอ คุณสามารถส่งข้อความ รูปภาพ หรือผลลัพธ์ก่อนหน้าเข้าไปได้ และโมเดลจะส่งกลับมาเป็น คลิป 720p ความยาว 3-10 วินาที ที่ 24 fps พร้อมเสียงซิงโครไนซ์ในตัว — ไม่ว่าจะเป็นเสียงบรรยากาศ เอฟเฟกต์ หรือแม้แต่คำพูด — ซึ่งถูกสร้างขึ้นพร้อมกับพิกเซล ไม่ใช่การเพิ่มเข้ามาภายหลัง Google ได้นำส่งโมเดลนี้ไปยังแอป Gemini, Flow และ YouTube Shorts ในเดือนพฤษภาคม 2026 และเปิด API (gemini-omni-flash-preview) ในวันที่ 30 มิถุนายน 2026 บน BananaBanana โมเดลนี้ทำงานจริงคู่กับตระกูล Veo 3.1: ให้ความสมดุลเท่ากัน, ราคาเดียว $1.00 ต่อการสร้างหนึ่งครั้ง, ชำระด้วยคริปโต

ทำไมถึงสร้างมาเพื่อ Shorts, Reels และ TikTok?

วิดีโอสั้นต้องการสามสิ่ง: เสียงเปิดโดยค่าเริ่มต้น, การเคลื่อนไหวที่น่าเชื่อถือ และการปรับปรุงที่รวดเร็ว Omni Flash มอบทั้งสามสิ่งนี้ เสียง เปิดตลอดเวลา — โมเดลจะตัดสินใจว่าฉากควรมีเสียงอย่างไรจากสิ่งที่แสดง การเคลื่อนไหวมาจากโมเดลระดับโลกที่ใช้หลักการคิดวิเคราะห์ฉาก: น้ำเชื่อมไหล, กระดาษลอย, ไอน้ำลอยขึ้นในจุดที่ควรจะเป็น — โดยปกติแล้วไม่จำเป็นต้องใช้พรอมต์ที่ซับซ้อน (สำหรับฉากที่เน้นฟิสิกส์มากๆ, Veo 3.1 ยังคงเป็นการเรนเดอร์ที่ปลอดภัยกว่า) และแทนที่จะต้องเขียนพรอมต์ใหม่ตั้งแต่ต้น คุณสามารถปรับแต่งได้ด้วย การสนทนา — เช่น “ทำให้เป็นยามพลบค่ำ”, “เพิ่มฝนบนหน้าต่าง” — ในขณะที่โมเดลยังคงรักษาตัวละคร แสง และมุมกล้องให้สอดคล้องกัน สร้างในรูปแบบแนวตั้ง 9:16 และคลิปจะพร้อมใช้งานบน Shorts, Reels หรือ TikTok ได้ทันทีโดยไม่ต้องครอป

หนึ่งการสร้างด้วย Omni Flash ในอัตราส่วน 9:16 แนวตั้ง — ผัดไทยผัดในกระทะบนเตาแก๊สริมถนน มีไอน้ำลอยขึ้น พร้อมเสียงผัดฉ่าและเสียงบรรยากาศตลาดที่สร้างขึ้นพร้อมกัน ราคาเดียว $1.00 พร้อมสำหรับ Shorts, Reels หรือ TikTok โดยไม่ต้องครอป
02ความสามารถ

สิ่งที่ Omni Flash ทำได้

เสียงซิงโครไนซ์เปิดตลอดเวลา

ทุกคลิปมาพร้อมเสียงที่สร้างขึ้น — เสียงบรรยากาศ, เอฟเฟกต์, คำพูด ควบคุมทิศทางเสียงได้ด้วยการเพิ่มบรรทัด "Audio:" ในพรอมต์

การแก้ไขแบบสนทนา

อธิบายการเปลี่ยนแปลง แล้วฉากจะถูกสร้างขึ้นใหม่โดยคงตัวละคร แสง และมุมกล้องไว้ การแก้ไขสามารถทำต่อเนื่องได้เรื่อยๆ

โมเดลระดับโลกที่รับรู้หลักฟิสิกส์

โมเดลจะใช้หลักการคิดวิเคราะห์ฉากแบบเดียวกับเอนจินฟิสิกส์ — ของเหลว ควัน และผ้า มักจะแสดงพฤติกรรมที่สมจริงได้ตั้งแต่ครั้งแรก

รูปภาพสู่วิดีโอ

รูปภาพใดๆ ก็สามารถเป็นเฟรมเปิดได้; พรอมต์จะอธิบายการเคลื่อนไหวและบรรยากาศเสียง

การอ้างอิงวัตถุ

รูปภาพอ้างอิงสูงสุด 3 รูป สามารถรักษารูปลักษณ์ของตัวละครหรือผลิตภัณฑ์ให้คงที่ในฉากใหม่ทั้งหมด

แนวตั้ง 9:16 หรือไวด์สกรีน 16:9

เลือกอัตราส่วนภาพสำหรับการสร้างแต่ละครั้ง — เอาต์พุตแนวตั้งจะจัดเฟรมมาเพื่อ Shorts, Reels และ TikTok โดยเฉพาะ

อีกหนึ่งการสร้างด้วย Omni Flash เพียงครั้งเดียว — น้ำเชื่อมราดบนแพนเค้ก พร้อมเสียง (เปิดเสียง: เสียงน้ำเชื่อมไหลก็สร้างขึ้นมาด้วย) เพียงหนึ่งพรอมต์ ไม่ต้องผ่านกระบวนการหลังการผลิตเสียง ราคาเดียว $1.00
03ข้อจำกัด

สิ่งที่ไม่ สามารถทำได้ — อย่างตรงไปตรงมา

นี่คือข้อจำกัดของ API ของ Google เอง ไม่ใช่จากการผสานรวมของเรา — และสิ่งเหล่านี้สำคัญที่คุณควรรู้ก่อนจะใช้จ่ายเงิน รองรับ 720p เท่านั้น: ไม่มีตัวเลือก 1080p หรือ 4K; หากคุณต้องการความละเอียดสูงขึ้น ให้ใช้ Veo 3.1 โมเดลจะเป็นผู้เลือกความยาว: ไม่มีพารามิเตอร์กำหนดความยาว ดังนั้นคลิปที่ต้องตัดให้เข้ากับเพลงอาจต้องลองหลายครั้ง ไม่รองรับ Extend: แตกต่างจาก Veo คุณไม่สามารถต่อคลิปให้เกิน 10 วินาทีได้ — การแก้ไขแบบสนทนาเป็นการเปลี่ยนฉาก ไม่ใช่การยืดความยาว

สิ่งที่ยังขาดหายไปจาก Preview API นี้คือ: seeds, พารามิเตอร์ negative-prompt, การปรับปรุงพรอมต์, การสร้างตัวอย่างหลายรายการต่อคำขอหนึ่งครั้ง และการปิดเสียง หากสิ่งเหล่านี้เป็นข้อจำกัดที่สำคัญสำหรับคุณ ตระกูล Veo 3.1 สามารถตอบโจทย์ได้ — ให้ความสมดุลเท่ากัน, ใช้เครื่องมือสร้างแบบเดียวกัน

04วิธีการทำงาน

จากพรอมต์สู่คลิป ในไม่กี่นาที

  1. สมัครฟรี

    เพียงอีเมลและรหัสผ่าน — ไม่ต้องใช้บัตรเครดิต ไม่ต้องมีบัญชี Google พร้อมยอดคงเหลือเริ่มต้นฟรี $0.10

  2. เติมเงินด้วยคริปโต

    เริ่มต้นที่ $1 ใน USDT, USDC, BTC, ETH, SOL, TON และสกุลเงินอื่นๆ โบนัส +5% เมื่อเติม $50 ขึ้นไป, +10% เมื่อเติม $100 ขึ้นไป

  3. สร้าง แล้วสนทนากับมัน

    เขียนพรอมต์ (เพิ่มบรรทัด "Audio:"), เลือกอัตราส่วน 16:9 หรือ 9:16, สร้างในราคา $1.00 — จากนั้นปรับแต่งโดยการอธิบายการเปลี่ยนแปลง

05ราคา

ราคาเดียว รวมเสียงแล้ว

เปรียบเทียบราคา Gemini Omni Flash กับคลิป Veo 3.1 ที่มีเสียง
โมเดลราคาต่อคลิประยะเวลาความละเอียดเสียง
Gemini Omni Flashราคาเดียว$1.003–10 วินาที (โมเดลเลือกให้)720pเปิดตลอดเวลา
Veo 3.1 Fastพร้อมเสียง$0.50–$1.004–8 วินาที (คุณเลือกเอง)สูงสุด 4Kเลือกได้
Veo 3.1พร้อมเสียง$1.50–$3.004–8 วินาที (คุณเลือกเอง)สูงสุด 4Kเลือกได้

ราคา Veo ที่แสดงสำหรับ 720p/1080p; 4K มีค่าใช้จ่ายเพิ่มเติม การแก้ไขแบบสนทนาด้วย Omni Flash ถือเป็นการสร้างใหม่ในราคาเดียว $1.00 ตารางราคาฉบับเต็มดูได้ที่หน้า pricing.

เปรียบเทียบโมเดลทั้งหมดบน หน้า pricing ฉบับเต็ม — หรืออ่าน รีวิวการใช้งาน Omni Flash API ก่อนตัดสินใจใช้จ่าย

06เรียนรู้เพิ่มเติม

คู่มือจาก บล็อก

07คำถามที่พบบ่อย

Gemini Omni Flash, มีคำตอบ

Gemini Omni Flash คืออะไร?

Gemini Omni Flash คือโมเดลแรกในตระกูล Gemini Omni ของ Google — ซึ่งเป็นโมเดลระดับโลกที่เปลี่ยนข้อความ รูปภาพ หรือคลิปก่อนหน้าให้เป็นวิดีโอสั้น 720p พร้อมเสียงที่ซิงโครไนซ์ซึ่งสร้างขึ้นพร้อมกันในขั้นตอนเดียว ได้มีการส่งมอบให้ผู้บริโภคในเดือนพฤษภาคม 2026 และเข้าถึง API ในชื่อ gemini-omni-flash-preview ในวันที่ 30 มิถุนายน 2026 บน BananaBanana โมเดลนี้ทำงานจริงคู่กับตระกูล Veo 3.1

วิดีโอ Gemini Omni Flash มีค่าใช้จ่ายเท่าไหร่?

ราคาเดียว $1.00 ต่อการสร้างหนึ่งครั้งบน BananaBanana ไม่ว่าโมเดลจะเลือกความยาวเท่าไหร่ (3–10 วินาที) — รวมเสียงแล้ว ไม่มีการสมัครสมาชิก การแก้ไขแบบสนทนาของคลิปที่มีอยู่เป็นการสร้างใหม่ในราคาเดียว $1.00 คุณสามารถเติมเงินด้วยคริปโตตั้งแต่ $1 และชำระเงินต่อคลิป

Gemini Omni Flash สร้างเสียงด้วยหรือไม่?

ใช่ — เสมอ ทุกคลิปมาพร้อมเสียงซิงโครไนซ์ในตัว: เสียงบรรยากาศ, เอฟเฟกต์, หรือแม้แต่คำพูดหากคุณร้องขอ คุณไม่สามารถปิดได้ การควบคุมเดียวคือข้อความ ดังนั้นให้คุณอธิบายบรรยากาศเสียงในบรรทัด "Audio:" ภายในพรอมต์

ฉันสามารถเลือกความยาวคลิปหรือความละเอียดได้หรือไม่?

ไม่ได้ API ไม่มีพารามิเตอร์กำหนดความยาว — โมเดลจะเลือกความยาว 3 ถึง 10 วินาทีตามพรอมต์ — และเอาต์พุตจะเป็น 720p ที่ 24 fps เท่านั้น คุณสามารถเลือกอัตราส่วนภาพได้: 16:9 สำหรับไวด์สกรีน หรือ 9:16 แนวตั้งสำหรับ Shorts, Reels และ TikTok

การแก้ไขแบบสนทนาทำงานอย่างไร?

สร้างคลิปขึ้นมา จากนั้นอธิบายการเปลี่ยนแปลง — เช่น "ทำให้มีหิมะตก", "เปลี่ยนแก้วมัคเป็นแก้วน้ำ" — และ Omni Flash จะสร้างฉากใหม่ขึ้นมาโดยคงตัวละคร แสง และมุมกล้องให้สอดคล้องกัน การแก้ไขสามารถทำต่อเนื่องกันได้ แต่ละการแก้ไขมีค่าใช้จ่ายเท่ากันคือ $1.00 ซึ่งมาแทนที่ฟังก์ชัน Extend แบบ Veo ที่ Omni ไม่รองรับ

ฉันควรใช้ Gemini Omni Flash หรือ Veo 3.1?

เลือก Omni Flash เมื่อเสียงมีความสำคัญและรูปแบบวิดีโอเป็นแนวตั้งสั้นหรือวิดีโอโซเชียล: เสียงเปิดตลอดเวลา, ฟิสิกส์ดูสมจริง, และการปรับปรุงทำได้โดยการสนทนาในราคาเดียว $1.00 เลือก Veo 3.1 เมื่อคุณต้องการการควบคุม — ความยาวที่แน่นอน 4/6/7/8 วินาที, ความละเอียดสูงสุด 4K, เสียงที่เลือกได้, เฟรมแรก/สุดท้าย และการขยายความยาวได้ถึง 148 วินาที

ฉันต้องมีบัญชี Google หรือบัตรเครดิตหรือไม่?

ไม่จำเป็น BananaBanana รับเฉพาะคริปโตเท่านั้น — USDT, USDC, BTC, ETH, SOL, TON และเหรียญหลักอื่นๆ โดยมียอดเติมขั้นต่ำ $1 สมัครด้วยอีเมล, เติมเงิน, สร้าง; ยอดคงเหลือที่ไม่ได้ใช้จะไม่มีวันหมดอายุ

สร้างคลิปแรกของคุณ พร้อมเสียง

Gemini Omni Flash — ราคาเดียว $1.00 ต่อคลิปพร้อมเสียงเปิดตลอดเวลา; Veo 3.1 เริ่มต้นที่ $0.10 ชำระเงินด้วยคริปโตตามการใช้งานจริง, ไม่มีการสมัครสมาชิก, ฟรี $0.10 สำหรับเริ่มต้น