Contact
Line : comsiam
Contact
Line : comsiam

Gemini สร้างภาพไม่ตรง Prompt มักเกิดจากคำสั่งกว้างเกินไป มีรายละเอียดขัดแย้งกัน ไม่ระบุตำแหน่งของตัวแบบ หรือขอให้เปลี่ยนหลายอย่างพร้อมกัน วิธีแก้คือเขียน Prompt ให้มีโครงสร้าง ระบุสิ่งสำคัญก่อน กำหนดตัวแบบ องค์ประกอบ การกระทำ สถานที่ สไตล์ แสง มุมกล้อง และอัตราส่วนให้ชัดเจน
หากภาพถูกต้องแล้วประมาณ 70–80% ไม่ควรสั่งสร้างใหม่ทั้งหมด ควรแก้ไขจากภาพเดิมโดยระบุเฉพาะจุดที่ต้องเปลี่ยน พร้อมบอกส่วนที่ต้องรักษาไว้
ทำตามขั้นตอนต่อไปนี้
ตัวอย่างคำสั่งแก้ภาพคือ
“ใช้ภาพล่าสุดเป็นต้นฉบับ เปลี่ยนเฉพาะสีเสื้อจากสีขาวเป็นสีน้ำเงินเข้ม รักษาใบหน้า ทรงผม ท่าทาง สัดส่วนร่างกาย ฉากหลัง แสง เงา มุมกล้อง และอัตราส่วนเดิมทั้งหมด”
สาเหตุที่พบบ่อยประกอบด้วย
• Prompt สั้นและกว้างเกินไป
• ใช้คำที่ตีความได้หลายความหมาย
• กำหนดองค์ประกอบไม่ชัดเจน
• มีคำสั่งขัดแย้งกัน
• เปลี่ยนหลายส่วนพร้อมกัน
• ไม่ระบุสิ่งที่ต้องรักษาไว้
• ใช้ภาพอ้างอิงคุณภาพต่ำ
• อัปโหลดภาพอ้างอิงหลายรูปโดยไม่บอกหน้าที่
• มีตัวละครหรือวัตถุมากเกินไป
• เลือกรุ่นที่เน้นความเร็วสำหรับงานซับซ้อน
• โมเดลมีข้อจำกัดด้านตัวอักษร จำนวนวัตถุ หรือรายละเอียด
• เนื้อหาบางส่วนถูกปรับเนื่องจากระบบความปลอดภัย
การเขียน Prompt ที่ยาวไม่ได้หมายความว่าจะได้ภาพตรงกว่าเสมอไป สิ่งสำคัญคือรายละเอียดต้องชัด เป็นระเบียบ และไม่ขัดแย้งกัน
Prompt ที่มีประสิทธิภาพสามารถเรียงตามโครงสร้างต่อไปนี้
ระบุให้ชัดว่าต้องการสร้างภาพใหม่ แก้ไขภาพเดิม รวมหลายภาพ หรือเปลี่ยนสไตล์
ตัวอย่าง
“สร้างภาพถ่ายโฆษณาสินค้าใหม่”
“แก้ไขเฉพาะพื้นหลังของภาพที่อัปโหลด”
“รวมองค์ประกอบจากภาพอ้างอิงทั้งสามภาพ”
บอกว่าตัวแบบคือใครหรืออะไร พร้อมลักษณะที่สำคัญ
ตัวอย่าง
“ผู้หญิงไทยวัยทำงาน ผมยาวสีดำ สวมเสื้อเชิ้ตสีขาว”
“ขวดน้ำหอมทรงสี่เหลี่ยม ฝาสีทอง ไม่มีโลโก้”
กำหนดตำแหน่ง ขนาด จำนวน และความสัมพันธ์ของวัตถุ
ตัวอย่าง
“วางสินค้าไว้ตรงกลางภาพ มีดอกไม้สีขาวอยู่ด้านซ้าย และเว้นพื้นที่ด้านขวาสำหรับข้อความ”
บอกว่าบุคคล สัตว์ หรือวัตถุกำลังทำอะไร
ตัวอย่าง
“กำลังเดินอยู่บนทางเท้าและถือแก้วกาแฟด้วยมือขวา”
ระบุสถานที่ เวลา สภาพแวดล้อม และรายละเอียดของฉาก
ตัวอย่าง
“อยู่ในสำนักงานสมัยใหม่ช่วงเช้า มีหน้าต่างกระจกและต้นไม้ขนาดเล็กด้านหลัง”
กำหนดว่าต้องการภาพถ่ายสมจริง การ์ตูน อนิเมะ 3D ภาพวาด หรือกราฟิกประเภทใด
ตัวอย่าง
“ภาพถ่ายสมจริงแบบงานโฆษณา”
“ภาพการ์ตูน 2D เส้นเรียบ สีพาสเทล”
บอกทิศทางแสง ลักษณะแสง และโทนสี
ตัวอย่าง
“แสงธรรมชาติอ่อนจากด้านซ้าย โทนอุ่น สีครีมและน้ำตาล”
ระบุมุมมอง ระยะภาพ และลักษณะของกล้อง
ตัวอย่าง
“มุมกล้องระดับสายตา ภาพครึ่งตัว เลนส์ 50 มม. ฉากหลังละลายเล็กน้อย”
เลือกให้เหมาะกับพื้นที่นำไปใช้
ตัวอย่าง
“อัตราส่วน 16:9 สำหรับภาพปก YouTube”
“อัตราส่วน 4:5 สำหรับโพสต์ Facebook”
ระบุสิ่งที่ต้องรักษาหรือรายละเอียดที่ต้องถูกต้อง
ตัวอย่าง
“รักษารูปทรงและสีของสินค้าตามภาพอ้างอิง ห้ามเปลี่ยนฉลากสินค้า”
“สร้างภาพถ่ายโฆษณากาแฟเย็นหนึ่งแก้ว แก้วใสไม่มีโลโก้ วางตรงกลางโต๊ะไม้สีอ่อน ฉากหลังเป็นร้านกาแฟสไตล์มินิมอลช่วงเช้า มีแสงธรรมชาติจากหน้าต่างด้านซ้าย โทนสีครีมและน้ำตาล มุมกล้องระดับสินค้า เลนส์ 50 มม. ฉากหลังละลายเล็กน้อย เว้นพื้นที่ด้านขวาสำหรับพาดหัว อัตราส่วน 4:5 ไม่มีบุคคลและไม่มีข้อความ”
Prompt นี้ระบุตัวแบบ ตำแหน่ง ฉาก แสง สี มุมกล้อง พื้นที่ข้อความ และอัตราส่วนครบถ้วน จึงลดพื้นที่ที่ Gemini ต้องคาดเดาเอง
Prompt แบบรวมคำสั้นจำนวนมาก เช่น
“ผู้หญิง, คาเฟ่, สวย, สมจริง, 4K, แสงดี, มือถูกต้อง”
อาจทำให้โมเดลไม่เข้าใจความสัมพันธ์ขององค์ประกอบ
ควรเขียนเป็นประโยคบรรยาย เช่น
“สร้างภาพถ่ายสมจริงของผู้หญิงไทยวัยทำงานกำลังนั่งอ่านหนังสือในร้านกาแฟ เธออยู่ด้านซ้ายของภาพ มือทั้งสองวางอยู่บนหนังสืออย่างเป็นธรรมชาติ แสงเช้าอ่อน ๆ จากหน้าต่างด้านขวา เว้นพื้นที่ด้านบนสำหรับข้อความ อัตราส่วน 4:5”
การเขียนเหมือนอธิบายงานให้ช่างภาพหรือนักออกแบบ มักให้ผลลัพธ์ควบคุมง่ายกว่าการเรียงคำศัพท์โดยไม่มีความสัมพันธ์
Google แนะนำให้บอกสิ่งที่ต้องการให้ปรากฏในภาพอย่างชัดเจน แทนการเขียนรายการสิ่งที่ไม่ต้องการจำนวนมาก
ตัวอย่างที่ควรหลีกเลี่ยง
“ถนนที่ไม่มีรถ ไม่มีคน ไม่มีป้าย ไม่มีต้นไม้ และไม่มีอาคาร”
ตัวอย่างที่ชัดกว่า
“ถนนเปล่าในพื้นที่ชนบท มีเพียงพื้นถนนและท้องฟ้า มองเห็นเส้นขอบฟ้าโล่ง”
คำอธิบายเชิงบวกช่วยให้โมเดลเห็นภาพเป้าหมาย ส่วนรายการคำห้ามจำนวนมากอาจทำให้ Gemini ให้ความสำคัญผิดหรือสร้างสิ่งที่กล่าวถึงขึ้นมาแทน
สามารถใช้ข้อห้ามได้เมื่อจำเป็น แต่ควรจำกัดไว้เฉพาะเงื่อนไขสำคัญ เช่น ไม่มีข้อความ ไม่มีโลโก้ หรือไม่มีบุคคล
คำว่า “มีคนกับสินค้าอยู่ในภาพ” ไม่ได้บอกว่าแต่ละอย่างควรอยู่ตรงไหน Gemini จึงต้องตัดสินใจเอง
ควรระบุตำแหน่ง เช่น
• บุคคลอยู่ด้านขวา
• สินค้าอยู่ตรงกลาง
• โลโก้อยู่มุมซ้ายบน
• มีพื้นที่ว่างด้านซ้าย
• วัตถุอยู่ด้านหน้าบุคคล
• ฉากหลังอยู่ไกลและละลายเล็กน้อย
หากมีวัตถุหลายชิ้น ควรบอกจำนวนและตำแหน่งให้ครบ
ตัวอย่าง
“วางขวดสินค้าหนึ่งขวดตรงกลาง ขนาบด้วยใบไม้สีเขียวหนึ่งใบทางซ้ายและหนึ่งใบทางขวา ไม่มีวัตถุอื่นบนแท่น”
ถ้าไม่ระบุจำนวน Gemini อาจเพิ่มวัตถุหรือบุคคลมากกว่าที่ต้องการ
แทนที่จะเขียนว่า
“สร้างภาพคนประชุมในสำนักงาน”
ให้เขียนว่า
“สร้างภาพคนทำงานสามคนกำลังประชุมรอบโต๊ะ มีผู้หญิงหนึ่งคนและผู้ชายสองคน ทุกคนนั่งและมองเอกสารกลางโต๊ะ”
สำหรับวัตถุที่จำนวนต้องถูกต้อง ควรย้ำในตอนท้ายอีกครั้ง เช่น
“ในภาพต้องมีแก้วกาแฟทั้งหมดสองแก้วเท่านั้น”
ถึงแม้จะระบุชัด ระบบยังอาจนับผิด จึงควรตรวจจำนวนก่อนใช้งาน
หากต้องการภาพซับซ้อน ไม่ควรใส่ทุกอย่างใน Prompt แรกเสมอไป เพราะองค์ประกอบจำนวนมากอาจทำให้โมเดลละเลยรายละเอียดบางส่วน
ใช้วิธีแบ่งงานดังนี้
“สร้างห้องนั่งเล่นสไตล์มินิมอล มุมกล้องกว้าง แสงเช้า อัตราส่วน 16:9”
“เพิ่มโซฟาสีครีมตรงกลางและโต๊ะไม้ทรงกลมด้านหน้า รักษาห้องและมุมกล้องเดิม”
“เพิ่มต้นไม้หนึ่งต้นข้างหน้าต่างด้านซ้ายและโคมไฟตั้งพื้นด้านขวา รักษาองค์ประกอบอื่นไว้”
“เปลี่ยนโทนภาพให้อบอุ่นขึ้นเล็กน้อย โดยไม่เปลี่ยนสีเฟอร์นิเจอร์”
วิธีนี้ช่วยให้ตรวจสอบความถูกต้องในแต่ละขั้นและย้อนกลับได้ง่าย
เมื่อภาพใกล้เคียงกับสิ่งที่ต้องการ ไม่ควรกดสร้างใหม่ทั้งหมด เพราะองค์ประกอบที่ถูกต้องอาจหายไป
ให้ใช้คำสั่งลักษณะนี้
“ใช้ภาพล่าสุดเป็นต้นฉบับ รักษาทุกอย่างเหมือนเดิม เปลี่ยนเฉพาะ…”
ตัวอย่าง
“ใช้ภาพล่าสุดเป็นต้นฉบับ รักษาบุคคล ฉากหลัง แสง สี และมุมกล้องเดิม เปลี่ยนเฉพาะแก้วในมือให้เป็นแก้วกาแฟใส”
การแก้เฉพาะจุดเป็นหนึ่งในความสามารถสำคัญของ Nano Banana และมักได้ผลดีกว่าการสร้าง Prompt ใหม่จากศูนย์
Gemini อาจแก้ส่วนอื่นของภาพตามไปด้วย หากไม่ได้ระบุว่าต้องรักษาอะไรไว้
ให้เพิ่มข้อความลักษณะนี้ใน Prompt
“เปลี่ยนเฉพาะพื้นหลัง”
“รักษาใบหน้าและทรงผมเดิม”
“ห้ามเปลี่ยนรูปทรงและสีของสินค้า”
“รักษาตำแหน่ง มุมกล้อง และแสงเดิม”
“คงข้อความและการจัดวางทุกตำแหน่ง”
“ไม่ต้องสร้างภาพใหม่ ให้แก้จากภาพล่าสุด”
ควรระบุเฉพาะองค์ประกอบที่สำคัญจริง เพราะการล็อกทุกอย่างพร้อมกับขอแก้ไขหลายส่วนอาจทำให้คำสั่งขัดแย้งกัน
หาก Gemini เปลี่ยนหน้าบุคคลระหว่างแก้ภาพ ให้ทำดังนี้
ตัวอย่าง Prompt คือ
“ใช้บุคคลจากภาพอ้างอิงเป็นตัวแบบหลัก รักษารูปหน้า ดวงตา จมูก ปาก คิ้ว ทรงผม สีผิว และอายุให้เหมือนต้นฉบับ เปลี่ยนเฉพาะเสื้อผ้าเป็นชุดสูทสีกรมท่า รักษาท่าทาง ฉากหลัง และมุมกล้องเดิม”
AI ไม่สามารถรับประกันความเหมือน 100% โดยเฉพาะเมื่อเปลี่ยนท่าทาง อายุ แสง หรือมุมใบหน้าอย่างมาก
ภาพโฆษณาสินค้าต้องรักษารูปร่าง สี ฉลาก และสัดส่วนให้ตรงกับสินค้าจริง
แนวทางแก้คือ
ตัวอย่าง Prompt คือ
“ใช้สินค้าจากภาพอ้างอิงโดยรักษารูปทรง ขนาด สี ฝา ฉลาก โลโก้ และข้อความบนบรรจุภัณฑ์ให้เหมือนต้นฉบับ เปลี่ยนเฉพาะพื้นหลังเป็นสตูดิโอสีครีม เพิ่มเงาใต้สินค้าอย่างเป็นธรรมชาติ ห้ามสร้างฉลากหรือข้อความใหม่”
สำหรับโฆษณาที่ต้องการความถูกต้องสูง ควรนำภาพสินค้าจริงไปจัดวางบนฉากที่สร้างด้วย AI ภายหลัง แทนการให้ AI สร้างตัวสินค้าขึ้นใหม่ทั้งหมด
เมื่ออัปโหลดหลายภาพ ต้องกำหนดหน้าที่ของแต่ละภาพให้ชัดเจน เช่น
• ภาพที่ 1 ใช้ใบหน้าบุคคล
• ภาพที่ 2 ใช้เสื้อผ้า
• ภาพที่ 3 ใช้ฉากหลัง
• ภาพที่ 4 ใช้โทนสีและสไตล์
ตัวอย่าง Prompt คือ
“ใช้บุคคลและใบหน้าจากภาพที่ 1 ใช้ชุดจากภาพที่ 2 และใช้ฉากร้านกาแฟจากภาพที่ 3 จัดให้บุคคลยืนตรงกลาง รักษาหน้าตาจากภาพที่ 1 ห้ามผสมใบหน้าจากภาพอื่น ปรับแสงบนบุคคลให้เข้ากับฉาก”
หากยังสับสน ให้ลดจำนวนภาพอ้างอิงและทำงานเป็นขั้นตอน เช่น สร้างตัวแบบก่อนแล้วค่อยเปลี่ยนฉาก
แม้ Nano Banana รุ่นใหม่จะสร้างข้อความได้ดีขึ้น แต่ยังอาจสะกดผิด โดยเฉพาะภาษาไทยที่มีสระและวรรณยุกต์
วิธีเพิ่มความแม่นยำคือ
ตัวอย่าง Prompt คือ
“ใส่ข้อความว่า ‘ลดราคาวันนี้’ ตามตัวสะกดนี้ทุกตัวอักษร วางไว้ด้านบนกึ่งกลาง ใช้ตัวอักษรไทยสีขาวขนาดใหญ่ อ่านง่าย ห้ามเพิ่มข้อความหรือเครื่องหมายอื่น”
หากข้อความต้องถูกต้อง 100% วิธีที่ปลอดภัยกว่าคือสร้างภาพพื้นหลังโดยไม่มีข้อความ แล้วนำไปใส่ตัวอักษรด้วยโปรแกรมออกแบบภายหลัง
ให้ระบุท่าทางของมือและสิ่งที่มือสัมผัสอย่างชัดเจน เช่น
“มือซ้ายวางราบบนโต๊ะ มือขวาจับหูแก้วกาแฟ นิ้วมือทั้งห้าอยู่ในตำแหน่งตามธรรมชาติ”
ถ้ามือไม่ได้เป็นส่วนสำคัญของภาพ สามารถเลือกองค์ประกอบที่ลดความเสี่ยง เช่น
• ภาพครึ่งตัวที่ไม่เห็นมือ
• วางมือไว้หลังตัว
• ใช้วัตถุบังมือบางส่วน
• เปลี่ยนมุมกล้อง
• ใช้ภาพระยะไกล
หากภาพโดยรวมดีแล้ว ให้สั่งแก้เฉพาะมือแทนการสร้างทั้งภาพใหม่
ใช้คำที่อธิบายตำแหน่งอย่างตรงไปตรงมา เช่น
• ซ้ายของภาพ
• ขวาของภาพ
• กึ่งกลาง
• ด้านหน้า
• ด้านหลัง
• มุมซ้ายบน
• หนึ่งในสามด้านขวา
• พื้นที่ว่างด้านบน
• จัดเรียงจากซ้ายไปขวา
ตัวอย่าง Prompt คือ
“วางบุคคลไว้บริเวณหนึ่งในสามด้านขวาของภาพ ให้ใบหน้าหันเข้าหากึ่งกลาง เว้นพื้นที่ว่างด้านซ้ายประมาณ 40% สำหรับข้อความ”
ถ้าการจัดวางมีความสำคัญมาก สามารถอัปโหลดภาพร่างหรือ Layout ง่าย ๆ เพื่อใช้เป็นข้อมูลอ้างอิง
หลีกเลี่ยงคำกว้าง ๆ เช่น “สวย” “หรู” หรือ “ทันสมัย” เพราะแต่ละคำตีความได้หลายแบบ
ให้อธิบายคุณสมบัติของสไตล์ เช่น
แทนคำว่า “ภาพหรู” ใช้ว่า
“พื้นหลังสีดำด้าน แสงขอบสีทอง วัสดุหินอ่อน เงาสะท้อนบาง ๆ องค์ประกอบเรียบและมีพื้นที่ว่าง”
แทนคำว่า “การ์ตูนน่ารัก” ใช้ว่า
“ภาพการ์ตูน 2D เส้นโค้งมน สีพาสเทล ดวงตาขนาดใหญ่ รายละเอียดเรียบง่าย เหมาะสำหรับเด็ก”
หากมีภาพสไตล์อ้างอิง ให้อัปโหลดแล้วระบุว่าต้องการใช้เฉพาะโทนสี เส้น แสง หรือพื้นผิว ไม่ใช่คัดลอกตัวละครหรือผลงานทั้งหมด
คำเกี่ยวกับกล้องช่วยให้ Gemini เข้าใจองค์ประกอบได้ดีขึ้น เช่น
• Close-up ภาพระยะใกล้
• Medium shot ภาพครึ่งตัว
• Full-body shot ภาพเต็มตัว
• Eye-level มุมระดับสายตา
• Low angle มุมต่ำ
• High angle มุมสูง
• Top-down มองจากด้านบน
• Aerial view มุมมองจากอากาศ
• Wide shot ภาพมุมกว้าง
• Over-the-shoulder มองข้ามไหล่
ตัวอย่าง Prompt คือ
“ภาพถ่ายเต็มตัว มุมกล้องระดับสายตา ตัวแบบอยู่ห่างจากกล้องประมาณสามเมตร ใช้เลนส์ 50 มม. ไม่ตัดศีรษะ มือ หรือเท้าออกจากกรอบ”
คำว่า “แสงสวย” กว้างเกินไป ควรระบุประเภทและทิศทางของแสง เช่น
• แสงธรรมชาติช่วงเช้า
• แสงอาทิตย์ยามเย็น
• แสงสตูดิโอนุ่ม
• แสงหลักจากด้านซ้าย
• แสงขอบด้านหลัง
• เงาอ่อน
• แสงคอนทราสต์สูง
• แสงกระจายจากหน้าต่าง
ตัวอย่าง
“ใช้แสงธรรมชาติอ่อนจากหน้าต่างด้านซ้าย เงาตกไปทางขวา และมีแสงขอบเล็กน้อยด้านหลังตัวแบบ”
รายละเอียดนี้ช่วยลดปัญหาแสงและเงาไม่สัมพันธ์กัน
หากสร้างภาพเสร็จแล้วค่อยเปลี่ยนอัตราส่วน องค์ประกอบอาจถูกครอบหรือจัดวางใหม่
ควรกำหนดตั้งแต่ต้น เช่น
• 1:1 สำหรับภาพสี่เหลี่ยม
• 4:5 สำหรับโพสต์แนวตั้ง
• 9:16 สำหรับ Story และวิดีโอแนวตั้ง
• 16:9 สำหรับภาพปก YouTube
• 3:2 สำหรับภาพถ่าย
• 4:1 สำหรับแบนเนอร์แนวยาว
พร้อมระบุพื้นที่ว่างสำหรับข้อความหรือปุ่มที่ต้องวางภายหลัง
Gemini รองรับ Prompt ภาษาไทย แต่บางคำศัพท์ด้านภาพถ่าย ภาพยนตร์ และการออกแบบอาจมีความหมายเฉพาะในภาษาอังกฤษ
สามารถเขียนแบบผสมได้ เช่น
“สร้างภาพถ่ายสินค้าแบบ Photorealistic ใช้ Eye-level camera, 50mm lens, soft studio lighting และ shallow depth of field”
หากผลลัพธ์ภาษาไทยไม่ตรง ให้ทดลองแปลเฉพาะคำเทคนิคเป็นภาษาอังกฤษ ไม่จำเป็นต้องเปลี่ยน Prompt ทั้งหมด
ผู้ใช้ Gemini Apps ไม่จำเป็นต้องเขียน Prompt เป็น JSON ภาษาธรรมดาที่มีโครงสร้างชัดเจนก็เพียงพอและแก้ไขง่ายกว่า
JSON อาจมีประโยชน์กับนักพัฒนาที่ต้องจัดเก็บข้อมูลหรือสร้าง Prompt อัตโนมัติ แต่ไม่ได้รับประกันว่าภาพจะตรงกว่า Prompt แบบข้อความเสมอไป
สิ่งสำคัญคือความชัดเจน ความสอดคล้อง และรายละเอียดที่จำเป็น ไม่ใช่รูปแบบวงเล็บหรือชื่อฟิลด์
เหมาะกับภาพร่าง งานง่าย และการทดลองอย่างรวดเร็ว แต่ไม่เหมาะกับภาพอ้างอิงหลายภาพหรือการแก้ไขต่อเนื่องที่ซับซ้อน
เหมาะกับงานทั่วไป ให้สมดุลระหว่างคุณภาพ ความเร็ว การสร้างข้อความ และความสม่ำเสมอของภาพอ้างอิง
เหมาะกับองค์ประกอบซับซ้อน ภาพระดับมืออาชีพ ข้อความจำนวนมาก งานรักษาแบรนด์ และงานที่ต้องใช้เหตุผลมากขึ้น
หากสร้างภาพด้วย Nano Banana 2 แล้วผลลัพธ์ยังไม่ตรง ผู้สมัครแพ็กเกจที่รองรับอาจเลือกเมนูเพิ่มเติมและสั่ง “Redo with Pro” เพื่อสร้างภาพใหม่ด้วย Nano Banana Pro
“สร้างภาพร้านอาหารสวย ๆ”
“สร้างภาพถ่ายสมจริงของร้านอาหารไทยสมัยใหม่ช่วงเย็น โต๊ะไม้สีเข้มจำนวนหกโต๊ะ ไม่มีลูกค้าในร้าน มีโคมไฟแขวนแสงสีส้ม ผนังปูนสีเทาและต้นไม้สีเขียว มุมกล้องกว้างระดับสายตาจากทางเข้าร้าน อัตราส่วน 16:9”
Prompt ใหม่ช่วยลดสิ่งที่โมเดลต้องคาดเดาและกำหนดองค์ประกอบสำคัญครบกว่าเดิม
“สร้างห้องมืดที่สว่างมาก มีเฟอร์นิเจอร์เยอะแต่ดูโล่ง ไม่มีคนแต่มีพนักงานกำลังทำงาน”
Prompt นี้มีเงื่อนไขขัดแย้งกันหลายจุด
“สร้างสำนักงานสมัยใหม่ที่มีแสงน้อย โคมไฟตั้งโต๊ะให้แสงเฉพาะจุด ภายในห้องมีโต๊ะทำงานสองตัวและเก้าอี้สองตัว ไม่มีบุคคล จัดองค์ประกอบให้มีพื้นที่ว่างตรงกลาง”
ควรเลือกความหมายเดียวให้แต่ละส่วนของภาพ
ก่อนกดสร้างภาพ ให้ตรวจว่า Prompt ระบุข้อมูลต่อไปนี้ครบหรือยัง
✅ ต้องการสร้างหรือแก้ไขภาพ
✅ ตัวแบบหลักคืออะไร
✅ มีตัวแบบทั้งหมดกี่คนหรือกี่ชิ้น
✅ แต่ละองค์ประกอบอยู่ตำแหน่งใด
✅ ตัวแบบกำลังทำอะไร
✅ ฉากและสถานที่เป็นแบบใด
✅ ต้องการภาพสไตล์ใด
✅ ใช้โทนสีและแสงแบบใด
✅ มุมกล้องและระยะภาพเป็นอย่างไร
✅ ต้องการอัตราส่วนเท่าใด
✅ ส่วนใดต้องรักษาไว้
✅ มีข้อความที่ต้องสะกดถูกหรือไม่
หาก Prompt ครบแต่ยาวเกินไป ให้แบ่งเป็นการสร้างภาพพื้นฐานและการแก้ไขต่อเนื่องแทน
การสร้างภาพด้วย AI มีความแปรผัน ผลลัพธ์แต่ละครั้งจึงอาจไม่เหมือนกัน แม้ใช้คำสั่งเดียวกัน หากได้ภาพที่ใกล้เคียงควรแก้จากภาพนั้นแทนการเริ่มใหม่
ไม่เสมอไป Prompt ยาวที่มีคำสั่งขัดแย้งอาจให้ผลลัพธ์แย่กว่า Prompt สั้นที่ชัดเจน ควรใส่เฉพาะรายละเอียดที่มีผลต่อภาพ
เพราะระบบสร้างภาพส่วนที่เกี่ยวข้องขึ้นใหม่ ให้สั่งว่าเปลี่ยนเฉพาะสีเสื้อ และระบุให้รักษาใบหน้า ทรงผม ท่าทาง ฉากหลังและมุมกล้องเดิม
โมเดลอาจเติมรายละเอียดตามบริบท ควรระบุจำนวน ตำแหน่ง และองค์ประกอบของฉากให้ชัดเจน พร้อมบอกว่าวัตถุใดต้องมีในภาพเท่านั้น
ถ้าภาพเดิมผิดแนวคิดหลักควรสร้างใหม่ แต่ถ้าถูกต้องแล้วประมาณ 70–80% ควรแก้เฉพาะจุดจากภาพเดิม
ช่วยได้ โดยเฉพาะงานรักษาใบหน้า สินค้า ตัวละคร สไตล์ และ Layout แต่ต้องบอกหน้าที่ของภาพอ้างอิงแต่ละภาพให้ชัดเจน
Nano Banana Pro เหมาะกับงานที่ซับซ้อนและต้องการการควบคุมสูงกว่า แต่ไม่รับประกันว่าจะถูกต้องทุกครั้ง Prompt ที่ชัดเจนและภาพอ้างอิงที่ดีมีความสำคัญเสมอ
หากภาพสองหรือสามครั้งยังผิดในลักษณะเดิม ควรหยุดสร้างซ้ำแล้วปรับ Prompt แบ่งงานเป็นขั้นตอน หรือเพิ่มภาพอ้างอิง
เมื่อ Gemini สร้างภาพไม่ตรง Prompt ให้ลดความคลุมเครือและจัดคำสั่งตามลำดับ ได้แก่ งานที่ต้องการ ตัวแบบ องค์ประกอบ การกระทำ สถานที่ สไตล์ แสง มุมกล้อง อัตราส่วน และข้อกำหนดสำคัญ
ควรบรรยายสิ่งที่ต้องการในเชิงบวก ระบุจำนวนและตำแหน่งของวัตถุ สร้างภาพพื้นฐานก่อนเพิ่มรายละเอียด และแก้ภาพครั้งละหนึ่งหรือสองจุด
หากภาพใกล้เคียงแล้ว ให้ใช้ภาพเดิมเป็นต้นฉบับและสั่งว่า “เปลี่ยนเฉพาะ” พร้อมระบุส่วนที่ต้องรักษาไว้ วิธีนี้ช่วยลดปัญหาใบหน้า สินค้า ฉากหลัง และองค์ประกอบที่ถูกต้องเปลี่ยนตามคำสั่งใหม่