Contact
Line : comsiam
Contact
Line : comsiam

Google Gemini สามารถใช้ แก้ไขวิดีโอด้วย Prompt ได้แล้ว ไม่จำเป็นต้องสร้างวิดีโอใหม่ทุกครั้งเมื่อมีบางส่วนผิด เช่น ต้องการลบคนด้านหลัง เปลี่ยนวัตถุ เปลี่ยน Background เปลี่ยนมุมกล้อง หรือปรับฉากใหม่
ปัจจุบัน Gemini Apps ใช้ Gemini Omni เป็นระบบสร้างและแก้ไขวิดีโอ โดย Google ระบุว่ารองรับทั้ง Video-to-Video Editing และ Multi-turn Editing หมายความว่าสามารถอัปโหลดวิดีโอหรือสร้างวิดีโอขึ้นมาก่อน แล้วพิมพ์คำสั่งธรรมดาเพื่อแก้ไขต่อหลายรอบในบทสนทนาเดียวได้
ตัวอย่างง่าย ๆ เช่น
“ลบผู้ชายที่อยู่ด้านหลังออก และเติม Background ให้ต่อเนื่อง”
“เปลี่ยนรถสีแดงเป็นสีดำ”
“เปลี่ยน Camera Angle เป็นมุมต่ำ”
“รักษาทุกอย่างเดิม เปลี่ยนเฉพาะฉากจากกลางวันเป็นกลางคืน”
หัวใจสำคัญคือ ไม่ต้องอธิบายวิดีโอใหม่ทั้งหมดทุกครั้ง
ถ้าวิดีโอเดิมดีอยู่แล้ว 90% ให้บอก Gemini ว่า
รักษาส่วนที่ถูกต้องไว้ และแก้เฉพาะส่วนที่ผิด
นี่เป็นแนวทางที่ Google DeepMind แนะนำสำหรับ Gemini Omni โดยตรง เพราะระบบถูกออกแบบให้แก้ Video ผ่าน Natural Conversation และรักษาส่วนที่ดีไว้ระหว่างการแก้หลายรอบ
ได้
Google ระบุความสามารถหลักของ Gemini Omni ใน Gemini Apps ได้แก่
Video-to-Video Edit
Multi-turn Editing
Aspect Ratio Control
Video Generation จาก Text/Image/Video Reference
และการสร้าง Audio ร่วมกับ Video
สำหรับการ Edit หลังสร้าง Video แล้ว Google ยกตัวอย่างโดยตรงว่า Gemini สามารถ
ลบ Object
เปลี่ยน Object
ลบ Character
เปลี่ยน Character
เปลี่ยน Camera Angle
แก้ Scene
ได้ด้วย Prompt ง่าย ๆ
ดังนั้น Gemini ไม่ได้เป็นเพียง AI สำหรับสร้าง Clip แต่สามารถใช้เป็น Conversational Video Editor ได้ด้วย
ระบบปัจจุบันคือ
Gemini Omni
Google เปิดตัว Gemini Omni ในปี 2026 โดยวางแนวคิดว่าเป็นโมเดลที่
สร้างสิ่งต่าง ๆ จาก Input หลากหลายประเภท โดยเริ่มจาก Video
และรวมความสามารถด้าน Reasoning, Multimodality และ Generative Media เข้าด้วยกัน
Google DeepMind อธิบาย Gemini Omni แบบเข้าใจง่ายว่า
คล้าย Nano Banana แต่สำหรับวิดีโอ
กล่าวคือ ผู้ใช้สามารถสร้างงานแล้วคุยกับ AI เพื่อแก้ต่อได้เรื่อย ๆ แทนการสร้างใหม่ตั้งแต่ต้นทุกครั้ง
โปรแกรม Video Editor แบบดั้งเดิมมักต้อง
เลือก Timeline
เลือก Layer
Mask Object
Keyframe
Color Grade
ปรับ Effect
ด้วยเครื่องมือแต่ละชนิด
แต่ Gemini Omni เปิดทางให้สั่งด้วยภาษาธรรมชาติ เช่น
“เปลี่ยนผีเสื้อเป็นผึ้ง”
แล้วรอบต่อไป
“เปลี่ยนผึ้งเป็นฝูงหิ่งห้อยขนาดเล็ก”
Google DeepMind ใช้ตัวอย่างลักษณะนี้เพื่อแสดง Multi-turn Editing ของ Omni โดยให้แก้เฉพาะสิ่งที่ต้องการโดยไม่ต้องสร้าง Scene ใหม่ทั้งหมด
มี 2 Workflow หลัก
① สร้าง Video ด้วย Gemini
② รอให้ Video สร้างเสร็จ
③ พิมพ์ Prompt ต่อใน Conversation เดิม
④ ระบุสิ่งที่ต้องการเปลี่ยน
⑤ Submit
ตัวอย่าง
“รักษาวิดีโอเดิมทั้งหมด เปลี่ยนเฉพาะรถสีแดงเป็นรถสีดำ”
Gemini จะสร้าง Version ใหม่โดยพยายามรักษาส่วนอื่นไว้
Google ระบุว่าสามารถแก้ Generated Video ด้วย Prompt ได้โดยตรงหลังจาก Generation เสร็จ
Gemini Omni รองรับ Video-to-Video Edit
Workflow คือ
① เปิด Gemini
② เข้า Create video / Videos
③ เลือก Add video
④ อัปโหลด Video
⑤ เขียน Prompt บอกสิ่งที่ต้องแก้
⑥ Submit
Google Help ระบุว่า Video Creation Workflow รองรับการอัปโหลด หนึ่งวิดีโอและสูงสุด 5 รูป เพื่อใช้เป็น Reference ในงานที่รองรับ
ยังไม่ใช่ทุกพื้นที่
Google ระบุว่าการ อัปโหลด Video เพื่อใช้เป็น Video Edit ยังไม่พร้อมใช้งานในบางพื้นที่ เช่น
EEA
Switzerland
United Kingdom
และบางรัฐของสหรัฐฯ
ดังนั้นถ้าบัญชีหนึ่งมี Create Video แต่ไม่มีตัวเลือก Upload Video/Edit อาจเกี่ยวข้องกับ Region ของบัญชีหรือบริการ
ใช้สูตร
PRESERVE + CHANGE ONLY + TARGET
หรือภาษาไทย
รักษาอะไร + เปลี่ยนเฉพาะอะไร + ต้องการให้เป็นแบบไหน
ตัวอย่าง
“รักษาตัวละคร Camera Movement, Lighting และ Background เดิมทั้งหมด เปลี่ยนเฉพาะเสื้อของผู้ชายจากสีขาวเป็นสีดำ”
สูตรนี้มีประโยชน์มากกว่าการเขียนว่า
“เปลี่ยนเสื้อเป็นสีดำ”
เพราะ Prompt แรกกำหนดสิ่งที่ ห้ามเปลี่ยน ไว้ด้วย
Generative Video ไม่ได้ทำงานเหมือน Photoshop ที่เปลี่ยน Pixel เพียงจุดเดียวเสมอไป
เมื่อ Generate Version ใหม่ ระบบอาจสร้างรายละเอียดบางส่วนใหม่ เช่น
หน้า
มือ
เสื้อ
Background
Lighting
Movement
ดังนั้นถ้ามีสิ่งสำคัญที่ต้องเหมือนเดิม ควรบอกชัด
ตัวอย่าง
“Preserve the character identity, face, hairstyle, clothing, movement, camera angle, lighting and environment. Change only the red car in the background to a black car.”
สมมติ Video มีคนเดินผ่านด้านหลัง
อย่าเขียนเพียง
“ลบคนนี้”
ควรเขียน
“ลบผู้ชายที่เดินอยู่ด้านหลังทางขวาออก เติมพื้นที่ Background ที่หายไปให้ต่อเนื่องกับกำแพงและพื้นเดิม รักษาบุคคลหลัก Camera Movement, Lighting และวัตถุอื่นไว้เหมือนเดิม”
Google ระบุ Removing Characters เป็นหนึ่งในตัวอย่าง Video Editing โดยตรงของ Gemini Apps
“Remove only the person walking in the background on the right side. Reconstruct the missing environment naturally. Preserve the main subject, camera movement, lighting, shadows and all other objects.”
ตัวอย่างต้องการลบ
รถ
ถังขยะ
ป้าย
โต๊ะ
สินค้า
ใช้ Prompt
“ลบรถสีขาวที่จอดอยู่ด้านหลังออก เติมถนนและ Background ให้ต่อเนื่องตามธรรมชาติ รักษารถหลักและ Camera Movement เดิมทั้งหมด”
การระบุ
ตำแหน่ง
สี
ชนิดวัตถุ
ช่วยลดโอกาสลบผิด Object
Google ระบุว่าสามารถ Replace Objects ได้โดยตรง
ตัวอย่าง
“เปลี่ยนแก้วกาแฟสีขาวบนโต๊ะเป็นแก้วเซรามิกสีดำ รักษาขนาด ตำแหน่ง Movement, Perspective, Lighting และ Shadow ให้สัมพันธ์กับวิดีโอเดิม”
หรือ
“เปลี่ยนรถสีแดงเป็นรถสีดำ แต่รักษารูปทรง การเคลื่อนไหว ล้อ Reflection และมุมกล้องเดิม”
ใน Gemini Apps Community มีตัวอย่างใช้ Omni เปลี่ยนช็อกโกแลตที่กำลังราดบนครัวซองต์ให้กลายเป็นชีสละลาย พร้อมเพิ่มดนตรีใน Prompt เดียว แสดงให้เห็นว่างาน Video Editing สามารถแก้ Visual และ Audio ไปพร้อมกันได้ใน Workflow ที่รองรับ
สามารถเปลี่ยน Character ได้เช่นกัน
ตัวอย่าง
“เปลี่ยนตัวละครหุ่นยนต์ตรงกลางเป็นนักบินอวกาศ รักษา Pose, Action, Camera Movement และ Environment เดิม”
อย่างไรก็ตาม หาก Character ใหม่ซับซ้อนมาก Video อาจมีการเปลี่ยนรายละเอียดรอบข้างด้วย
ดังนั้นควรตรวจ
Movement
Scale
Shadow
Interaction
หลัง Generate
นี่เป็นหนึ่งในจุดเด่นของ Gemini Omni
Google Help ระบุโดยตรงว่าสามารถ Changing Camera Angles ผ่าน Prompt ได้
ตัวอย่าง
“รักษาตัวละคร Action, Scene, Lighting และ Timing เดิม เปลี่ยนเฉพาะ Camera Angle เป็น Low-angle Shot จากด้านหน้า”
หรือ
“เปลี่ยนมุมกล้องเป็น Over-the-shoulder จากด้านหลังตัวละคร โดยรักษา Movement เดิม”
Google DeepMind แสดงตัวอย่าง Prompt ที่ขอ
Close-up ที่รองเท้า
Tilt ขึ้นอย่างรวดเร็วเป็น Medium Shot
จากนั้น Widen Out
แสดงให้เห็นว่า Omni สามารถตีความ Camera Direction หลายขั้นภายใน Edit เดียวได้
ตัวอย่างคำที่มีประโยชน์
Static
Locked-off
Fixed
Close-up
Medium Shot
Wide Shot
Push In
Punch In
Dolly Zoom
Tilt Up
Tilt Down
Natural Smartphone Zoom
Film Camera Style
Google DeepMind แนะนำศัพท์ Camera เหล่านี้โดยตรงสำหรับ Prompt Omni
ตัวอย่าง Video กล้องเร็วเกินไป
ใช้
“รักษาวิดีโอเดิมทั้งหมด ลดความเร็ว Camera Movement ลงประมาณครึ่งหนึ่ง ทำ Movement ให้นุ่มและเสถียรมากขึ้น”
ถ้าต้องการกล้องอยู่กับที่
“เปลี่ยน Camera เป็น Static locked-off shot และรักษา Action ของตัวละครเดิม”
ถ้าต้องการเข้าใกล้ Subject
“เพิ่ม Slow Push In toward the subject throughout the shot.”
ได้
Google DeepMind แนะนำให้ใช้คำ
one continuous shot
หรือ
oner
เมื่อต้องการ Shot ต่อเนื่องโดยไม่ตัด
ตัวอย่าง
“รักษา Scene เดิม แต่ทำให้เป็น one continuous shot กล้องติดตามตัวละครตลอดโดยไม่มี Cut”
ตัวอย่าง
“รักษาบุคคล Movement, Camera, Clothing และ Lighting Direction เดิม เปลี่ยนเฉพาะ Background จากสำนักงานเป็นร้านกาแฟ Modern Minimal”
หรือ
“เปลี่ยนเฉพาะ Environment เป็นชายหาดช่วง Golden Hour และปรับ Shadow ให้สัมพันธ์กับแสงใหม่”
Google DeepMind แนะนำ Background Change เป็นตัวอย่างสำคัญของ Iterative Editing โดยไม่ต้อง Prompt Scene ใหม่ทั้งหมด
“Preserve the subject, action, timing and camera movement. Change only the environment to a modern minimalist office with large windows and soft daylight. Keep the transition natural and maintain consistent lighting on the subject.”
Prompt
“รักษาตัวละคร อาคาร Movement และ Camera เดิม เปลี่ยน Scene จากกลางวันเป็นกลางคืน เพิ่ม Moonlight, Street Lights และแสงจากหน้าต่างให้สมจริง”
อย่าบอกเพียง
“ทำให้เป็นกลางคืน”
เพราะอาจทำให้แค่ลด Brightness
การบอกแหล่งกำเนิดแสงใหม่ช่วยให้ผลดูสมจริงมากขึ้น
สามารถใช้ Prompt เช่น
“เปลี่ยน Lighting จากแสงกลางวันเป็น Golden Hour โดยรักษา Scene, Camera และ Character เดิม”
“เพิ่ม Soft Rim Light จากด้านหลัง”
“เปลี่ยนแสงเป็น Blue Neon Lighting”
“ทำ Shadow ให้นุ่มขึ้น”
Lighting เป็นหนึ่งในองค์ประกอบที่ Google DeepMind แนะนำให้ระบุชัดใน Prompt Omni
Gemini Omni สามารถใช้ Natural Language เพื่อปรับ Style ของงานได้
เช่น
Photorealistic
Anime
Claymation
Watercolor
Cinematic
Documentary
Prompt
“รักษา Motion, Timing และ Camera Movement เดิม เปลี่ยนเฉพาะ Visual Style เป็น Claymation”
หรือ
“เปลี่ยนวิดีโอนี้เป็น Anime Style โดยรักษา Character Action และ Composition เดิม”
Gemini Omni ถูกออกแบบให้ Reference และแก้ Media ผ่านการสนทนา ไม่ได้จำกัดอยู่กับ Text-to-Video เท่านั้น
Gemini Apps รองรับการสร้าง Audio พร้อม Video และ Gemini Omni สามารถใช้ Prompt ที่รวมการแก้ Visual และ Audio ได้
ตัวอย่าง
“รักษาภาพเดิมทั้งหมด ลบ Background Music และเพิ่มเสียงฝนเบา ๆ”
หรือ
“ลดเสียง Ambient ลงและทำให้เสียงเครื่องยนต์เด่นขึ้น”
หรือ
“เพิ่มดนตรี Instrumental จังหวะเบา ๆ โดยไม่เปลี่ยน Visual”
“Keep the visual unchanged. Add subtle instrumental background music with a calm cinematic mood. Keep the music lower than the environmental sound.”
“รักษาภาพเดิม เพิ่มเสียงฝนตกบนพื้นและเสียง Thunder เบา ๆ ในระยะไกล โดยไม่มีเพลง”
ใน Workflow ที่รองรับ Audio Generation สามารถระบุ Dialogue เป็นส่วนหนึ่งของ Video Prompt ได้
ถ้าต้องแก้คำพูด ควรบอก
ผู้พูด
ประโยค
ภาษา
น้ำเสียง
ตัวอย่าง
“รักษาวิดีโอและตัวละครเดิม ให้ผู้หญิงพูดภาษาไทยว่า ‘ยินดีต้อนรับค่ะ’ ด้วยน้ำเสียงเป็นมิตร และไม่เพิ่มประโยคอื่น”
ควรตรวจ
คำพูด
เสียง
Lip Sync
Identity
อีกครั้งหลัง Generate
Gemini Omni สามารถใช้ Prompt เพื่อปรับ Content หลายองค์ประกอบ และ Google DeepMind ระบุว่าการแก้ Iteratively สามารถขอ Update เฉพาะ เช่น Background หรือ Caption ได้โดยไม่ต้อง Prompt Scene ใหม่ทั้งหมด
ตัวอย่าง
“รักษาวิดีโอเดิมทั้งหมด เพิ่มข้อความ ‘COMING SOON’ ตรงกลางในช่วงท้าย เป็นตัวอักษรสีขาว Fade In ช้า ๆ”
ถ้าเป็นภาษาไทย
“เพิ่มข้อความ ‘พบกันเร็ว ๆ นี้’ ตรงตามตัวอักษรและห้ามเพิ่มข้อความอื่น”
แต่ควรตรวจ Spelling ก่อนเผยแพร่
Prompt
“รักษา Facial Identity, hairstyle, body proportions, action, camera and background เดิม เปลี่ยนเฉพาะเสื้อเชิ้ตสีขาวเป็นเสื้อเชิ้ตสีดำทรงเดิม”
ถ้าเสื้อผ้ามี Pattern
ระบุ Pattern
Material
Color
ให้ชัด
เพื่อช่วย Consistency ระหว่าง Frame
ถ้า Character สำคัญ ให้เขียน
“Preserve the original facial identity throughout every frame. Do not change the eyes, eyebrows, nose, lips, face shape, skin tone, hairstyle or age.”
ถ้ามี Image Reference สามารถเพิ่มภาพอ้างอิงในแต่ละ Turn ได้ เพราะ Gemini Omni รองรับ Multi-turn Editing ที่แต่ละรอบสามารถมี Image หรือ Video Reference เพิ่มเข้ามาได้
ได้
Google Help ระบุว่าแต่ละ Turn ของ Multi-turn Editing สามารถมี Image หรือ Video Reference ได้ และ Video Creation รองรับสูงสุด 5 รูปพร้อม Video หนึ่งไฟล์ใน Workflow ปัจจุบัน
ตัวอย่าง
อัปโหลดรูปหน้าตัวละครเพิ่ม แล้วสั่ง
“ใช้ Image Reference นี้เป็น Master Identity และรักษาหน้านี้ตลอด Edited Video”
วิธีนี้มีประโยชน์เมื่อ Video Version ก่อนเริ่มมี Identity Drift
ถ้าเป็นสินค้า ควรล็อก
Shape
Logo
Label
Packaging
Color
Material
Prompt
“ใช้สินค้าเดิมเป็น Master Product รักษารูปร่าง Logo, Label, Packaging, สีและ Material ตลอด Video เปลี่ยนเฉพาะ Background เป็น Premium Black Studio และเพิ่ม Golden Rim Light”
หลัง Generate ต้องตรวจรายละเอียดสินค้าในหลาย Frame
เพราะ Generative Video อาจสร้างข้อความหรือ Label ใหม่บางส่วน
Prompt
“รักษารูปทรงรถ ล้อ ไฟหน้า กระจก Movement และ Reflection เดิม เปลี่ยนเฉพาะสีตัวรถจากสีแดงเป็น Matte Black”
Prompt นี้ดีกว่า
“ทำรถให้ดำ”
เพราะระบุสิ่งที่ต้อง Preserve
Prompt
“รักษาจาน Background และ Camera เดิม เปลี่ยนเฉพาะซอสช็อกโกแลตที่ราดบนอาหารให้เป็นชีสละลาย พร้อมรักษาการไหลและ Movement ให้สัมพันธ์กับวิดีโอต้นฉบับ”
งานลักษณะ Replace Material/Object เป็น Use Case ที่มีตัวอย่างจริงกับ Omni ใน Gemini Apps Community
Multi-turn Editing หมายถึงการแก้ Video ต่อเนื่องหลายครั้ง
เช่น
“เปลี่ยนรถเป็นสีดำ”
“รักษารถใหม่ไว้ เปลี่ยนฉากเป็นกลางคืน”
“เพิ่มฝน”
“เปลี่ยน Camera Angle เป็น Low Angle”
แทนการเขียน Prompt ยาว ๆ สั่งทั้งหมดตั้งแต่ครั้งแรก
Google ระบุ Multi-turn Editing เป็นความสามารถหลักของ Gemini Omni และแต่ละ Turn สามารถเพิ่ม Reference ใหม่ได้
เพราะตรวจได้ทันทีว่า Edit ไหนทำให้
หน้าเปลี่ยน
Background พัง
Movement ผิด
สินค้าเพี้ยน
ถ้าแก้ 7 อย่างพร้อมกันแล้ว Output ผิด จะหาสาเหตุยาก
Workflow ที่ดีคือ
แก้หนึ่งจุด → ตรวจ → แก้จุดต่อไป
สมมติ Video มีรถสีแดงวิ่งกลางวัน
แต่ต้องการ Final เป็นรถดำกลางคืนและฝนตก
“เปลี่ยนเฉพาะรถเป็น Matte Black”
ตรวจรถ
“รักษารถใหม่ เปลี่ยน Scene เป็นกลางคืน”
ตรวจ Lighting
“เพิ่มฝนเบา ๆ และ Wet Road Reflection”
ตรวจ Physics
“เพิ่มเสียงฝน”
ตรวจ Audio
วิธีนี้ควบคุมได้ง่ายกว่าทำทั้งหมดใน Prompt เดียว
Google DeepMind ระบุว่า Omni ถูกออกแบบให้ Preserve Video across multiple amendments หรือรักษาส่วนที่ทำงานดีอยู่แล้วขณะผู้ใช้ Focus ไปยังสิ่งที่ต้องปรับใหม่
อย่างไรก็ตาม คำว่า Preserve ไม่ได้หมายถึง
Pixel-perfect 100%
ทุก Frame
เพราะ Model ยังคงเป็น Generative AI
จึงควรตรวจ Output ทุก Version
ถ้า Version แรก
หน้าเหมือน
สินค้าเหมือน
Scene ถูก
แต่หลัง Edit 5–6 รอบเริ่มเพี้ยน
อย่า Edit ต่อจาก Version ที่ผิด
ให้ย้อนกลับไป Version ที่ดีที่สุด
แล้วเริ่ม Branch ใหม่จากตรงนั้น
แนวทางที่ควรใช้คือ
Original → Master → Edit → Best Version → Final
ไม่ควร Save ทับ Master
ควรดาวน์โหลดหรือเก็บ Version ที่ดีไว้
เช่น
Master-01
Edit-02
Edit-03
Final
เพราะหาก AI เปลี่ยนรายละเอียดที่ต้องการรักษา คุณสามารถย้อนกลับได้ทันที
หลังได้ Video ที่ต้องการ
Google ระบุว่าสามารถใช้
Share → Download video
หรือ
Share on YouTube
ใน Workflow ที่รองรับ
ควร Download File โดยตรงแทน Screen Record เพื่อรักษาคุณภาพ Output
ได้
Gemini Apps Help สำหรับ Android ระบุความสามารถเดียวกัน ได้แก่
Video-to-Video Edit
Multi-turn Editing
และการแก้ Generated Video ผ่าน Prompt
ขั้นตอนทั่วไปคือ
① เปิด Gemini
② Videos
③ Add video หรือเปิด Generated Video
④ พิมพ์ Prompt
⑤ Submit
Gemini Apps Help บน iPhone/iPad ระบุว่าสามารถแก้ Generated Video ผ่าน Prompt เช่น
นำวัตถุหรือตัวละครออก
แทนที่วัตถุหรือตัวละคร
เปลี่ยนมุมกล้อง
แก้ Scene
ได้เช่นกัน
สิทธิ์จริงยังขึ้นอยู่กับบัญชี Plan อายุ และ Region
สำหรับ Personal Google Account Google Help ปัจจุบันระบุว่าต้องมี Google AI Plan เพื่อใช้ Gemini Omni Video Generation/Editing ใน Gemini Apps
บัญชี Work/School ต้องมี Qualifying Workspace License
และ Feature นี้ยังไม่พร้อมให้ผู้ใช้อายุต่ำกว่า 18 ปี
ดังนั้นถ้าไม่เห็นเมนู Video Edit ให้ตรวจ
Plan
บัญชี
Workspace License
อายุ
Region
ก่อน
ได้
Multi-turn Editing ของ Gemini Omni อนุญาตให้แต่ละ Turn มี Image หรือ Video Reference เพิ่มได้
ตัวอย่าง
Video มีเสื้อผิด
Upload ภาพเสื้อจริง
แล้ว Prompt
“ใช้เสื้อจาก Image Reference เป็น Clothing Reference เปลี่ยนเฉพาะเสื้อของตัวละคร โดยรักษาใบหน้า Action และ Camera เดิม”
นี่ให้ Control มากกว่าการอธิบายเสื้อด้วยข้อความอย่างเดียว
ใน Gemini Apps Workflow ปัจจุบัน Google ระบุว่าสามารถ Upload
หนึ่งวิดีโอ + สูงสุดห้ารูป
ได้
ตัวอย่าง
Image 1 = หน้า
Image 2 = เสื้อ
Image 3 = รองเท้า
Image 4 = Product
Image 5 = Location
ควร Label ให้ชัดว่าแต่ละรูปใช้ทำอะไร
“Video = Master Motion
Image 1 = Face Reference
Image 2 = Clothing Reference
รักษา Movement และ Camera จาก Master Video ใช้ Facial Identity จาก Image 1 และเปลี่ยนเสื้อให้ตรง Image 2 ห้ามเปลี่ยน Background”
การกำหนดบทบาทแต่ละไฟล์ช่วยลดความสับสน
Google DeepMind ระบุว่า ยิ่งเพิ่มรายละเอียดที่เกี่ยวข้อง ผู้ใช้ยิ่งควบคุม Final Output ได้มากขึ้น โดยองค์ประกอบสำคัญมี
Shot Framing
Camera Motion
Style
Lighting
Location
Action
แต่สำหรับ Editing ไม่ต้องอธิบาย Scene ใหม่ทั้งหมด
ควร Focus เฉพาะ
อะไรที่รักษา
อะไรที่เปลี่ยน
และผลใหม่ควรเป็นอย่างไร
ใช้ Template นี้ได้
“Use the current video as the master.
Preserve:
[สิ่งที่ต้องเหมือนเดิม]
Change only:
[สิ่งที่ต้องเปลี่ยน]
New result:
[รายละเอียดผลลัพธ์ใหม่]
Do not alter:
[รายการที่ห้ามเปลี่ยน]”
“ใช้วิดีโอปัจจุบันเป็น Master
รักษา:
[ตัวละคร/กล้อง/ฉาก/เสียง]
เปลี่ยนเฉพาะ:
[สิ่งที่ต้องแก้]
ให้เป็น:
[ผลใหม่]
ห้ามเปลี่ยน:
[สิ่งสำคัญ]”
“ใช้วิดีโอเดิมเป็น Master รักษาบุคคลหลัก กล้อง Lighting และ Environment เดิม ลบเฉพาะผู้ชายด้านหลังขวา และเติม Background ให้ต่อเนื่องตามธรรมชาติ”
“รักษาวิดีโอเดิมทั้งหมด เปลี่ยนเฉพาะรถสีแดงเป็นรถสีดำด้าน รักษารูปทรง ล้อ Movement, Reflection และ Perspective เดิม”
“รักษาตัวละคร Action, Environment, Lighting และ Timing เดิม เปลี่ยนเฉพาะ Camera Angle เป็น Low-angle tracking shot จากด้านหน้า”
“รักษาตัวละคร อาคาร Camera Movement และ Action เดิม เปลี่ยน Scene เป็นกลางคืน มี Moonlight, warm streetlights และ realistic reflections”
“รักษา Action, Timing, Camera และ Composition เดิม เปลี่ยน Visual Style เป็น cinematic anime animation”
“รักษา Visual เดิมทั้งหมด ลบ Background Music และเพิ่มเสียงฝนกับ Ambient Street Sound แบบสมจริง”
“รักษา Facial Identity ของบุคคลเดิมตลอดทุก Frame ห้ามเปลี่ยนดวงตา จมูก ริมฝีปาก รูปหน้า สีผิว อายุ และทรงผม เปลี่ยนเฉพาะ Background”
“รักษาสินค้า Shape, Logo, Label, Packaging, Color และ Material เดิมตลอด Video เปลี่ยนเฉพาะ Background เป็น Premium Black Studio และเพิ่ม Soft Golden Rim Light”
คลุมเครือเกินไป
ไม่มี Target
ไม่บอกว่า Scene แบบใด
ถ้า Identity สำคัญ ควรบอก Facial Features ที่ห้ามเปลี่ยน
จาก
“ทำวิดีโอให้ Cinematic”
เป็น
“รักษาตัวละคร Action และ Camera Path เดิม เปลี่ยนเฉพาะ Lighting เป็น Cinematic Golden Hour เพิ่ม Contrast เล็กน้อยและ Soft Rim Light”
จาก
“ลบของด้านหลัง”
เป็น
“ลบถังขยะสีเขียวด้านหลังซ้ายออก เติมกำแพงและพื้นให้ต่อเนื่องกับ Environment เดิม”
ไม่เหมือนทั้งหมด
Gemini Omni เก่งด้าน Generative Editing ผ่านภาษา
แต่โปรแกรม Video Editor แบบดั้งเดิมยังเหมาะกว่าสำหรับงานที่ต้องการ
ตัด Frame แม่นยำ
Timeline หลาย Track
Keyframe Exact
Subtitle Exact
Color Management
Audio Mixing ละเอียด
Motion Graphics
Logo Pixel-perfect
ดังนั้น Workflow ที่ดีอาจเป็น
Gemini → Generative Edit → Video Editor → Final Production
แทนการพยายามทำทุกอย่างด้วย AI ตัวเดียว
เหมาะมากกับ
เปลี่ยน Object
ลบ Object
เปลี่ยน Character
แก้ Background
เปลี่ยน Scene
ปรับ Camera
เปลี่ยน Style
สร้าง Variation
Creative Concept
Social Video
B-roll
Product Concept
Advertising Concept
ตรวจ Identity
ตรวจ Logo/Packaging
ตรวจข้อความ ราคา และ Claim
ตรวจ Fact
ตรวจว่า AI ไม่สร้างรายละเอียดที่ไม่มีจริง
ต้องไม่ทำให้ผู้ชมเข้าใจผิดว่า AI-generated Scene เป็น Footage จริง
Google ระบุว่าผู้ใช้ต้องมีสิทธิในภาพที่ Upload และต้องไม่ละเมิด Copyright หรือ Privacy Rights รวมถึงต้องปฏิบัติตาม Terms of Service และ Prohibited Use Policy
หลักเดียวกันควรใช้กับ Video Reference
ก่อนอัปโหลดควรตรวจว่าคุณมีสิทธิ
ใช้
แก้ไข
เผยแพร่
หรือใช้งานเชิงพาณิชย์
ตามวัตถุประสงค์นั้นจริง
Google ระบุชัดว่าไม่ควรสร้างหรือแชร์วิดีโอเพื่อ
Deceive
Harass
Harm
ผู้อื่น และระบบอาจไม่สร้างหรือลบ Video หากตรวจพบการละเมิดเงื่อนไข
โดยเฉพาะ Video Edit ที่เกี่ยวกับบุคคลจริง ควรให้ความสำคัญกับ Consent และ Context
Google ระบุว่า Video Generation สามารถใช้เวลา หลายนาที และระหว่างประมวลผลจะไม่สามารถโต้ตอบกับ Chat เดิมได้ แต่สามารถเริ่ม Chat อื่นแล้วกลับมาดูผลภายหลัง
ดังนั้น Video Edit ช้ากว่า Text Response เป็นเรื่องปกติ
หากค้างผิดปกติให้ตรวจ
Network
Usage Limit
Browser/App
Prompt Complexity
และ Service Status
ใช้หลัก
อย่าแก้ทุกอย่างอีกครั้ง
ดูว่าอะไรผิดเพียงจุดเดียว
ตัวอย่าง
รถถูกแล้ว แต่ Background ผิด
ให้พิมพ์
“รถถูกต้องแล้ว รักษารถและ Camera เดิมทั้งหมด เปลี่ยนเฉพาะ Background…”
Google DeepMind แนะนำให้ใช้ Specific Update โดยไม่ต้อง Prompt Scene ใหม่ทั้งชุด เพราะ Omni สามารถ Preserve Video ระหว่าง Iterative Edits ได้
ดู Master Video
ระบุปัญหา 1 จุด
เขียน Preserve
เขียน Change Only
Generate
ตรวจ
ถ้าถูกค่อยไปจุดต่อไป
ตรวจตามนี้
คนหรือสินค้ายังเหมือนเดิมไหม
มี Identity Drift หรือไม่
ผิดรูปไหม
สิ่งที่แก้ถูกหรือยัง
เติม Scene เนียนหรือไม่
ตรง Prompt ไหม
มี Jump หรือไม่
ต่อเนื่องไหม
สมเหตุสมผลหรือไม่
สัมพันธ์กับ Object ใหม่ไหม
ถูกต้องหรือไม่
สัมพันธ์กับภาพไหม
รายละเอียดเปลี่ยนระหว่าง Frame หรือไม่
| ต้องการทำอะไร | Prompt หลัก |
|---|---|
| ลบคน | Remove character + reconstruct background |
| ลบของ | Remove object + preserve environment |
| เปลี่ยนของ | Replace object + preserve motion |
| เปลี่ยนหน้า/Character | Reference + preserve action |
| เปลี่ยน Background | Preserve subject + change environment |
| เปลี่ยนมุมกล้อง | Preserve scene + change camera |
| กล้องช้าลง | Preserve everything + reduce camera speed |
| เปลี่ยน Style | Preserve motion + change visual style |
| เพิ่มเสียง | Preserve visual + add audio |
| แก้เฉพาะบางส่วน | Preserve + Change Only |
จำเพียง
PRESERVE → CHANGE ONLY → VERIFY
กำหนดสิ่งที่ต้องเหมือนเดิม
บอกสิ่งที่ต้องแก้เพียงจุดเดียว
ตรวจ Version ใหม่ก่อนแก้ต่อ
นี่เหมาะกับความสามารถ Multi-turn Editing ของ Gemini Omni มากที่สุด
ได้ Gemini Omni รองรับ Video-to-Video Edit และ Multi-turn Editing ใน Gemini Apps
ได้ Google ระบุว่า Generated Video สามารถแก้ด้วย Prompt เพื่อนำ Object หรือ Character ออกได้
ได้ Google ระบุว่า Gemini สามารถ Replace Objects และ Characters ผ่าน Prompt ได้
ได้ การเปลี่ยน Camera Angle เป็นหนึ่งในความสามารถที่ Google ระบุโดยตรง และ DeepMind ยังแสดงตัวอย่างการสั่ง Camera Direction หลายขั้นด้วย Prompt
ได้ Gemini Omni รองรับ Scene Modification และ DeepMind แนะนำ Background Change เป็นตัวอย่างของ Iterative Editing
ได้ Multi-turn Editing ช่วยให้แก้วิดีโอต่อเนื่องภายใน Conversation เดียว และแต่ละ Turn สามารถมี Reference เพิ่มได้
ได้ในพื้นที่ที่รองรับ Gemini Omni มี Video-to-Video Edit แต่ Google ระบุว่าการ Upload Video สำหรับ Editing ยังไม่พร้อมในบาง Region
ได้ Video Workflow ปัจจุบันรองรับหนึ่ง Video และสูงสุดห้ารูป และแต่ละ Turn ของ Multi-turn Editing สามารถเพิ่ม Reference ได้
Gemini รองรับ Audio Generation ร่วมกับ Video และ Omni สามารถรับ Prompt ที่รวมการปรับ Visual/Audio ใน Workflow ที่รองรับ
สำหรับ Personal Account ปัจจุบัน Gemini Help ระบุว่าต้องมี Google AI Plan ส่วน Work/School Account ต้องมี Qualifying Workspace License
Google ระบุว่า Feature Video Generation/Editing นี้ยังไม่พร้อมสำหรับผู้ใช้อายุต่ำกว่า 18 ปี
ใต้ Video เลือก Share แล้วเลือก Download video หรือ Share on YouTube ใน Workflow ที่รองรับ
การแก้ไขวิดีโอด้วย Google Gemini ปัจจุบันทำได้มากกว่าการสร้าง Video ใหม่จาก Prompt เพราะ Gemini Omni รองรับ Video-to-Video Edit และ Multi-turn Editing
Google ระบุว่าสามารถใช้ Prompt เพื่อ
ลบหรือเปลี่ยน Object
ลบหรือเปลี่ยน Character
เปลี่ยน Camera Angle
แก้ Scene
และแก้ต่อหลายรอบภายใน Conversation เดียวได้
วิธีพื้นฐานมีสองแบบ
วิดีโอที่ Gemini สร้าง → พิมพ์ Prompt แก้ต่อ
หรือ
Upload Video → บอก Gemini ว่าต้องการแก้อะไร
จุดเด่นสำคัญคือไม่จำเป็นต้อง Prompt Video ใหม่ทั้งหมดทุกครั้ง
Google DeepMind แนะนำให้สั่ง Specific Update เช่น Background Change หรือ Camera Change โดย Omni จะพยายามรักษาส่วนที่ทำถูกอยู่แล้วระหว่างการแก้หลายรอบ
สูตร Prompt ที่ควรจำที่สุดคือ
PRESERVE + CHANGE ONLY + TARGET
ตัวอย่าง
“รักษาบุคคล Action, Camera Movement, Lighting และ Background เดิมทั้งหมด เปลี่ยนเฉพาะเสื้อสีขาวเป็นเสื้อสีดำ”
หรือ
“รักษาวิดีโอเดิมทั้งหมด ลบเฉพาะผู้ชายด้านหลัง และเติม Background ให้ต่อเนื่องตามธรรมชาติ”
สำหรับงานซับซ้อน ไม่ควรแก้ทุกอย่างพร้อมกัน
ใช้ Workflow
Master Video → แก้ 1 จุด → ตรวจ → แก้จุดต่อไป → ตรวจ → Final
จะช่วยลดปัญหา
หน้าเปลี่ยน
สินค้าเพี้ยน
Movement ผิด
Background พัง
และทำให้รู้ทันทีว่า Edit รอบใดเป็นต้นเหตุ
สรุปง่ายที่สุดคือ Gemini Video Editing ในยุค Gemini Omni ไม่ได้ทำงานแบบ
“สร้างคลิปใหม่ทุกครั้ง”
แต่ทำงานใกล้เคียงกับ
“คุยกับ AI แล้วบอกว่าในวิดีโอนี้ต้องแก้อะไร”
และสูตรที่ใช้ได้กับงานแทบทุกประเภทคือ
รักษาสิ่งที่ถูก → เปลี่ยนเฉพาะสิ่งที่ผิด → ตรวจผล → แก้ต่อทีละจุด
นี่คือวิธีใช้ Gemini Omni ให้ได้ประโยชน์สูงสุดสำหรับการแก้ไขวิดีโอด้วย AI ในปัจจุบัน