Contact
Line : comsiam
Contact
Line : comsiam

Text to Video คือการใช้ AI สร้างคลิปวิดีโอจากข้อความหรือ Prompt ผู้ใช้เพียงอธิบายตัวแบบ การกระทำ สถานที่ มุมกล้อง แสง และบรรยากาศที่ต้องการ ระบบจะสร้างภาพเคลื่อนไหวให้โดยไม่จำเป็นต้องถ่ายฉากนั้นด้วยตัวเอง
Canva มีพื้นที่สำหรับสร้างคลิปด้วย AI แล้วนำผลลัพธ์มาตัดต่อร่วมกับข้อความ รูปภาพ เพลง เสียงพากย์ และคำบรรยายได้ทันที บทความนี้จาก comsiam จะสอนวิธีทำ Text to Video ด้วย Canva AI ตั้งแต่แบ่งเรื่องเป็นฉาก เขียน Prompt ไปจนถึงรวมหลายคลิปและดาวน์โหลดเป็น MP4
Text to Video หมายถึงกระบวนการเปลี่ยนคำอธิบายที่เขียนเป็นข้อความให้กลายเป็นวิดีโอ ตัวอย่างเช่น หากพิมพ์ว่า
“พระอาทิตย์กำลังขึ้นเหนือภูเขา หมอกเคลื่อนช้าๆ กล้องเลื่อนไปด้านหน้า ภาพยนตร์สมจริง อัตราส่วน 16:9”
AI จะสร้างคลิปตามองค์ประกอบที่เข้าใจจาก Prompt นั้น ผลลัพธ์แต่ละครั้งอาจแตกต่างกัน แม้ใช้ข้อความเหมือนเดิม
Text to Video เหมาะกับการสร้างคลิปสั้นเป็นรายฉาก จากนั้นจึงนำหลายคลิปมาต่อกันตาม Storyboard มากกว่าการสั่งให้ AI สร้างวิดีโอยาวทั้งหมดในครั้งเดียว
คลิปจากข้อความสามารถนำไปใช้กับงานต่างๆ ได้แก่
ควรใช้คลิป AI เป็นเครื่องมือประกอบการเล่าเรื่อง ไม่ใช่ใช้แทนภาพจริงในส่วนที่ต้องแสดงหลักฐาน ขั้นตอน หรือรายละเอียดที่ถูกต้อง
เริ่มจากคำอธิบาย ผู้ใช้ไม่มีภาพต้นฉบับและให้ AI สร้างทั้งฉากกับการเคลื่อนไหว
เหมาะกับ
เริ่มจากภาพที่มีอยู่แล้ว แล้วให้ AI เพิ่มการเคลื่อนไหวให้กับภาพนั้น
เหมาะกับ
หากต้องการควบคุมรูปลักษณ์ของสินค้า ตัวละคร หรือสถานที่ Image to Video อาจช่วยกำหนดภาพเริ่มต้นได้ดีกว่า แต่ผลลัพธ์ยังต้องได้รับการตรวจสอบ
เขียนสรุปว่าวิดีโอต้องการสื่ออะไรภายในหนึ่งประโยค เช่น “วิดีโอแนะนำวิธีดูแลโทรศัพท์ในวันที่อากาศร้อน”
เขียนเสียงบรรยายหรือข้อความหลักก่อน เพื่อให้ทราบว่าแต่ละช่วงควรใช้ภาพอะไร
แบ่งเรื่องเป็นฉากและกำหนดภาพของแต่ละช่วง ไม่ควรเริ่มสร้างคลิปแบบสุ่มแล้วค่อยพยายามนำมาเชื่อมกันภายหลัง
กำหนดว่าจะใช้ 16:9 สำหรับวิดีโอแนวนอน หรือ 9:16 สำหรับวิดีโอแนวตั้ง
เลือกแนวทางเดียว เช่น สมจริง ภาพยนตร์ Animation ภาพวาด หรือ 3D เพื่อให้คลิปทุกฉากมีภาพรวมสอดคล้องกัน
สมมติว่าต้องการสร้างวิดีโอเรื่อง “การทำงานจากบ้านอย่างมีประสิทธิภาพ” สามารถแบ่งเป็นฉากได้ดังนี้
คนทำงานนั่งอยู่หน้าโต๊ะที่มีของวางรกและมีสีหน้าเหนื่อย
โทรศัพท์มีการแจ้งเตือนต่อเนื่อง ขณะที่ผู้ทำงานพยายามใช้โน้ตบุ๊ก
โต๊ะถูกจัดให้เรียบร้อย มีสมุดวางแผนและปิดการแจ้งเตือน
ผู้ทำงานมีสมาธิและทำงานเสร็จในห้องที่มีแสงสว่าง
แต่ละฉากควรมีการกระทำหลักเพียงหนึ่งอย่าง เพื่อให้ AI สร้างการเคลื่อนไหวได้ชัดเจนขึ้น
Prompt สามารถเขียนตามสูตรนี้
“[ตัวแบบ] กำลัง [การกระทำ] ใน [สถานที่] ช่วง [เวลา] มุมกล้อง [มุม] กล้อง [การเคลื่อนไหว] แสง [ลักษณะแสง] โทนสี [สี] อารมณ์ [อารมณ์] สไตล์ [รูปแบบ] อัตราส่วน [สัดส่วน] ไม่มี [สิ่งที่ไม่ต้องการ]”
องค์ประกอบแต่ละส่วนมีหน้าที่ดังนี้
เปิด Canva แล้วสร้างงานตามขนาดปลายทาง
เปิดส่วน Canva AI หรือเมนูแอปภายในหน้าออกแบบ แล้วค้นหาเครื่องมือสร้างคลิปจากข้อความ
ชื่อเมนูอาจแสดงเป็น AI Video, Text to Video, Video Generator หรือ Create a Video Clip ขึ้นอยู่กับภาษา บัญชี และเวอร์ชันที่ใช้
ตรวจสอบว่าเลือก Text to Video ไม่ใช่การสร้างภาพนิ่ง หากมีตัวเลือกหลายโมเดลหรือหลายรูปแบบ ควรอ่านคำอธิบายและการใช้เครดิตก่อนเลือก
ใส่คำอธิบายฉากที่เตรียมไว้ เริ่มด้วยตัวแบบและการกระทำก่อนตามด้วยรายละเอียดด้านภาพ
ตัวอย่าง:
“ชายกำลังจัดโต๊ะทำงานที่มีโน้ตบุ๊ก สมุด และโคมไฟ ภายในห้องทำงานสมัยใหม่ แสงเช้าจากหน้าต่าง กล้องเลื่อนจากซ้ายไปขวาช้าๆ บรรยากาศสงบ ภาพสมจริง อัตราส่วน 16:9 ไม่มีข้อความและโลโก้”
หากมีตัวเลือก ให้กำหนดให้ตรงกับงาน ไม่ควรสร้างคลิปแนวนอนแล้วนำไปครอบเป็นแนวตั้งโดยไม่คำนึงถึงตำแหน่งตัวแบบ
ตรวจสอบ Prompt แล้วกดสร้าง รอจนประมวลผลเสร็จ จำนวนครั้งและระยะเวลารอขึ้นอยู่กับบัญชี เครดิต และสถานะระบบ
ตรวจสอบทุกช่วง ไม่ใช่เพียงภาพตัวอย่าง เพราะวัตถุอาจเปลี่ยนรูปหรือเกิดความผิดปกติระหว่างการเคลื่อนไหว
เลือกผลลัพธ์ที่เหมาะสมแล้วนำเข้าสู่หน้าออกแบบ จากนั้นปรับขนาดและตำแหน่งให้พอดี
เลือกคลิปบน Timeline แล้วตัดหัว ท้าย หรือแบ่งเพื่อลบช่วงที่ผิดปกติ
ใช้โครง Prompt เดิมเพื่อรักษาสไตล์ แล้วเปลี่ยนเฉพาะการกระทำหรือมุมกล้องตาม Storyboard
เรียงคลิปตามสคริปต์ เพิ่ม Transition เฉพาะจุดที่จำเป็น แล้วปรับจังหวะให้ตรงกับเสียงบรรยาย
ใส่ข้อความจริงผ่านเครื่องมือของ Canva เพิ่มเสียงพากย์ เพลง คำบรรยาย และ Sound Effect
ตรวจงานทั้งหมด แล้วเลือกดาวน์โหลดเป็นวิดีโอ MP4
“เราเตอร์ Wi-Fi สีขาววางบนโต๊ะในบ้านสมัยใหม่ ไฟสถานะกะพริบเบาๆ กล้องเคลื่อนเข้าอย่างช้าๆ แสงสีน้ำเงินนุ่ม ภาพถ่ายสมจริง อัตราส่วน 16:9 ไม่มีข้อความ โลโก้ และคน”
“พ่อครัวกำลังผัดผักในกระทะ มีไอน้ำลอยขึ้น ครัวสะอาด แสงธรรมชาติ มุมกล้องระยะใกล้ กล้องอยู่กับที่ สีอบอุ่น ภาพสมจริง อัตราส่วน 9:16 ไม่มีตัวหนังสือ”
“รถตู้กำลังวิ่งบนถนนเลียบภูเขาในช่วงเช้า หมอกบางและแสงพระอาทิตย์สีทอง กล้องมุมกว้างเคลื่อนตามรถอย่างนุ่มนวล ภาพยนตร์สมจริง อัตราส่วน 16:9”
“กระเป๋าเป้สีดำวางบนแท่นในสตูดิโอ กล้องหมุนรอบสินค้าอย่างช้าๆ แสงขอบสีฟ้า พื้นหลังสีเทาเข้ม ภาพโฆษณาสมจริง อัตราส่วน 9:16 ไม่มีโลโก้และข้อความ”
“โต๊ะเรียนมีหนังสือ สมุด และดินสอจัดวางเป็นระเบียบ แสงเช้าส่องจากหน้าต่าง กล้องถ่ายจากด้านบนและเคลื่อนช้าๆ บรรยากาศสงบ ภาพสมจริง อัตราส่วน 16:9 เว้นพื้นที่ตรงกลางสำหรับข้อความ”
“เส้นแสงสีม่วงและฟ้าเคลื่อนไหวอย่างนุ่มนวลบนพื้นหลังสีดำ มีอนุภาคขนาดเล็กลอยช้าๆ พื้นที่กึ่งกลางเรียบสำหรับใส่หัวข้อ สไตล์เทคโนโลยี อัตราส่วน 16:9”
“Cinematic close-up of a modern white Wi-Fi router on a clean wooden desk, soft blue ambient light, indicator lights blinking gently, slow camera push-in, photorealistic, 16:9, no text, no logo, no people.”
ภาษาอังกฤษไม่ได้รับประกันว่าจะให้ผลลัพธ์ดีกว่าภาษาไทยทุกครั้ง ควรทดลองทั้งสองภาษาแล้วเลือก Prompt ที่ระบบตีความได้ตรงที่สุด
หากมีคน สัตว์ สินค้า และฉากหลายอย่างพร้อมกัน AI อาจสร้างความสัมพันธ์ผิด ควรเริ่มจากตัวแบบหลักหนึ่งอย่าง
คำว่า “กำลังใช้ชีวิตอย่างมีความสุข” กว้างเกินไป ควรเปลี่ยนเป็น “กำลังเดินริมทะเลและยิ้ม”
คำว่า “ภาพสวย” ไม่บอกตำแหน่งกล้อง ควรระบุภาพใกล้ ภาพครึ่งตัว ภาพมุมกว้าง หรือภาพจากด้านบน
หนึ่งคลิปควรใช้การเคลื่อนไหวหลัก เช่น ซูมเข้า เลื่อนด้านข้าง หรือกล้องนิ่ง ไม่ควรสั่งหลายทิศทางพร้อมกัน
ตัวอย่างเช่น “แสงกลางวันมืดมาก” หรือ “ภาพสมจริงแบบการ์ตูน” อาจทำให้ระบบตีความไม่ชัด ควรเลือกแนวทางเดียว
เพิ่มข้อความว่าไม่มีตัวอักษร ไม่มีโลโก้ ไม่มีลายน้ำ หรือไม่มีบุคคล หากองค์ประกอบเหล่านี้ไม่ควรปรากฏ
ความต่อเนื่องของตัวละครเป็นหนึ่งในข้อจำกัดที่สำคัญ ควรใช้รายละเอียดเดิมในทุก Prompt เช่น
ตัวอย่างคำอธิบายตัวละคร:
“ผู้หญิงไทยอายุประมาณ 30 ปี ผมดำยาวประบ่า สวมเสื้อเชิ้ตสีฟ้าและกางเกงสีดำ”
นำข้อความนี้ไปใช้ซ้ำทุกฉาก แล้วเปลี่ยนเฉพาะการกระทำ อย่างไรก็ตาม AI อาจยังสร้างรายละเอียดแตกต่าง จึงต้องตรวจผลลัพธ์และใช้ภาพอ้างอิงเมื่อเครื่องมือรองรับ
วางคลิปตามลำดับเหตุการณ์ ไม่ควรตัดสินจากความสวยของแต่ละคลิปเพียงอย่างเดียว
หากตัวแบบเดินออกด้านขวาในฉากแรก ฉากถัดไปควรมีทิศทางที่เชื่อมต่ออย่างสมเหตุสมผล
หากบางคลิปมีโทนสีต่างกันมาก ให้ปรับภาพหรือใช้ฉากคั่นเพื่อสร้างความต่อเนื่อง
ใช้เสียงเป็นโครงหลักแล้วเปลี่ยนภาพเมื่อเข้าสู่ประเด็นใหม่ ไม่ควรปล่อยคลิปสวยๆ ไว้นานเกินเนื้อหา
การตัดตรงเหมาะกับเหตุการณ์ต่อเนื่อง ส่วนการจางเหมาะกับการเปลี่ยนเวลา สถานที่ หรือหัวข้อ
AI อาจสร้างตัวอักษรที่อ่านไม่ได้ จึงควรสั่งให้ฉากไม่มีข้อความ แล้วใส่ข้อความจริงใน Canva ภายหลัง
ขั้นตอนมีดังนี้
หากต้องวางข้อความด้านหนึ่ง ควรระบุให้ AI เว้นพื้นที่บริเวณนั้นตั้งแต่ Prompt
เขียนสคริปต์ก่อนสร้างคลิป แล้วบันทึกเสียงเป็นช่วงสั้นเพื่อให้จัดภาพตามคำพูดได้ง่าย
เลือกเพลงที่เข้ากับอารมณ์ของวิดีโอและลดระดับให้เบากว่าเสียงบรรยาย ตรวจสอบสิทธิ์ก่อนเผยแพร่
เพิ่มเสียงที่สัมพันธ์กับภาพ เช่น เสียงฝน คลื่น ลม หรือเครื่องจักร เพื่อทำให้ฉากมีมิติมากขึ้น
ไม่ควรใส่เสียงที่ไม่ตรงกับการเคลื่อนไหว เพราะจะทำให้วิดีโอดูไม่เป็นธรรมชาติ
ใช้กระบวนการต่อไปนี้
วิดีโอควรมีการเรียบเรียง ความคิดเห็น ตัวอย่าง หรือข้อมูลของผู้สร้าง ไม่ควรเป็นเพียงคลิป AI หลายชิ้นที่นำมาต่อกันโดยไม่มีสาระใหม่
ใช้ขนาด 1080 × 1920 พิกเซลและอัตราส่วน 9:16
Shorts ควรมีประเด็นหลักชัด ไม่ควรใส่เรื่องย่อยจำนวนมาก
เริ่มด้วยคำถาม ปัญหา หรือผลลัพธ์ เช่น “ถ้าโลกไม่มีอินเทอร์เน็ตหนึ่งวัน จะเกิดอะไรขึ้น?”
ใช้หลายคลิปสั้นแทนการแสดงฉากเดิมนานเกินไป
หลีกเลี่ยงด้านขวาและด้านล่าง ซึ่งอาจถูกปุ่มและข้อมูลของแพลตฟอร์มบัง
ต้องตอบสิ่งที่เปิดไว้ตอนต้น ไม่ควรจบโดยไม่ให้ข้อมูลที่สัญญาไว้
เพิ่มการกระทำของตัวแบบและการเคลื่อนกล้องให้ชัด เช่น “กล้องเลื่อนเข้าอย่างช้าๆ”
ลดจำนวนตัวแบบ ใช้มุมกล้องง่ายขึ้น หรือสร้างใหม่หลายเวอร์ชันแล้วเลือกผลลัพธ์ที่ผิดปกติน้อยที่สุด
ระบุ 16:9 หรือ 9:16 ใน Prompt และเลือกอัตราส่วนในเครื่องมือหากมีตัวเลือก
ใช้คำอธิบายโทนสีและแสงชุดเดียวกันในทุก Prompt
เพิ่มคำว่า “ไม่มีข้อความ ไม่มีตัวอักษร ไม่มีโลโก้” แล้วสร้างข้อความจริงใน Canva
ระบุ “กล้องอยู่กับที่” หรือ “กล้องเคลื่อนอย่างช้าและนุ่มนวล”
ตรวจ Prompt โควตา อินเทอร์เน็ต สิทธิ์ของบัญชี และสถานะระบบ หากคำสั่งไม่ผ่านข้อกำหนด ควรปรับเนื้อหาให้เหมาะสม ไม่ควรพยายามหลีกเลี่ยงระบบป้องกัน
บัญชีบางประเภทอาจมีโควตาหรือเครดิตให้ทดลอง แต่จำนวนครั้ง ความยาว ความละเอียด และตัวเลือกของโมเดลอาจขึ้นอยู่กับแพ็กเกจ ประเทศ และช่วงเวลา
ควรตรวจข้อมูลภายในบัญชีก่อนเริ่มโครงการ เพราะข้อจำกัดสามารถเปลี่ยนได้ และการสร้างใหม่หลายครั้งอาจใช้เครดิตเร็วกว่าที่คาด
ไม่ควรนำภาพสังเคราะห์ไปอ้างว่าเป็นเหตุการณ์ ข่าว การทดลอง หรือผลลัพธ์ที่เกิดขึ้นจริง
ไม่ควรสร้างภาพบุคคลจริงในสถานการณ์ที่ไม่เคยเกิดขึ้น หรือทำให้ผู้ชมเชื่อว่าบุคคลนั้นรับรองสินค้า
AI อาจสร้างเครื่องหมายที่คล้ายแบรนด์จริงโดยไม่ได้ตั้งใจ ควรตรวจทุกเฟรมและสร้างใหม่เมื่อต้องการใช้งานเชิงพาณิชย์
หากคลิปแสดงเครื่องมือ ขั้นตอน หรือสถานที่เฉพาะ ต้องตรวจว่ารายละเอียดไม่ทำให้ผู้ชมเข้าใจผิด
ปฏิบัติตามกฎหมายและข้อกำหนดของแพลตฟอร์มเกี่ยวกับเนื้อหาสังเคราะห์หรือดัดแปลง โดยเฉพาะภาพที่ดูเหมือนเหตุการณ์จริง
อ่านเงื่อนไขของ Canva โมเดล AI เพลง ฟอนต์ และองค์ประกอบก่อนใช้กับงานโฆษณาหรืองานลูกค้า
เมื่อสร้างและตัดต่อเสร็จแล้ว ให้ดำเนินการดังนี้
ควรดูไฟล์จริงทั้งภาพและเสียงก่อนเผยแพร่ เพราะข้อผิดพลาดบางอย่างอาจเห็นได้ชัดขึ้นหลัง Export
ได้ หากบัญชีมีเครื่องมือ Text to Video หรือเครื่องมือสร้างคลิปด้วย AI ผู้ใช้สามารถพิมพ์ Prompt แล้วนำผลลัพธ์มาตัดต่อได้
ได้ แต่ผลลัพธ์อาจแตกต่างตามคำศัพท์และโมเดล หากไม่ตรงสามารถเพิ่มรายละเอียดหรือทดลอง Prompt ภาษาอังกฤษ
โดยทั่วไปเหมาะกับการสร้างคลิปสั้นทีละฉาก แล้วนำมาต่อกันตามสคริปต์มากกว่า วิธีนี้ช่วยควบคุมเนื้อหาและแก้ฉากที่ผิดได้ง่าย
ขึ้นอยู่กับเครื่องมือและโมเดล หากไม่มีเสียง สามารถเพิ่มเสียงพากย์ เพลง และ Sound Effect ภายใน Canva ได้
ใช้ได้ตามเงื่อนไขที่เกี่ยวข้อง แต่ควรเพิ่มการเรียบเรียงและคุณค่าของผู้สร้าง ตรวจสิทธิ์ และเปิดเผยเนื้อหาสังเคราะห์เมื่อจำเป็น
AI อาจไม่รักษาตัวละครอัตโนมัติ ควรใช้รายละเอียดรูปลักษณ์ เสื้อผ้า แสง และสไตล์ชุดเดิมในทุก Prompt หรือใช้ภาพอ้างอิงเมื่อระบบรองรับ
การทำ Text to Video ด้วย Canva AI เริ่มจากเขียนสคริปต์และแบ่งเป็นฉาก จากนั้นสร้าง Prompt ที่ระบุตัวแบบ การกระทำ สถานที่ กล้อง แสง สี สไตล์ และอัตราส่วนให้ชัดเจน แล้วสร้างคลิปทีละฉากก่อนนำมาต่อกันบน Timeline
ทุกคลิปต้องได้รับการตรวจสอบทั้งความต่อเนื่อง ความถูกต้อง และรายละเอียดผิดปกติ ควรใส่ข้อความจริงภายใน Canva และใช้ภาพจริงในส่วนที่ต้องเป็นหลักฐาน ก่อนดาวน์โหลดเป็น MP4 ให้ตรวจเสียง สิทธิ์ และการเปิดเผย AI วิธีนี้ช่วยให้งาน Text to Video ของ comsiam มีโครงเรื่องชัดและพร้อมนำไปใช้งานจริง