Contact
Line : comsiam
Contact
Line : comsiam

Gemini สร้างภาพไม่ตรง Prompt เป็นปัญหาที่สามารถเกิดขึ้นได้แม้ใช้ Nano Banana 2 รุ่นใหม่ เช่น สั่งเสื้อสีดำแต่ได้สีน้ำเงิน สั่งให้คนอยู่ด้านขวาแต่กลับอยู่ตรงกลาง สั่งแก้เฉพาะ Background แต่ใบหน้ากลับเปลี่ยน หรือขอข้อความภาษาไทยแล้วตัวหนังสือผิด
วิธีแก้ที่ได้ผลมากกว่าการกด Generate ซ้ำ ๆ คือ ทำ Prompt ให้ชัด แยกองค์ประกอบของภาพ บอกสิ่งที่ต้องรักษา บอกสิ่งที่ต้องเปลี่ยน และแก้ทีละจุด
Google ระบุว่า Nano Banana 2 มี Enhanced Instruction Following สำหรับทำตามคำขอที่ซับซ้อนขึ้น รวมถึง Character Consistency, Local Edits, Multiple Reference Images และ Better Text Rendering แต่ Generative AI ก็ยังไม่ได้รับประกันว่าผลทุกครั้งจะตรง Prompt 100%
ดังนั้นหาก Gemini สร้างภาพไม่ตรงใจ อย่าเพิ่งสรุปว่าโมเดลไม่เก่ง เพราะหลายครั้งปัญหาเกิดจาก Prompt ที่ยังเปิดช่องให้ AI ตีความเองมากเกินไป
สาเหตุหลักมักมีดังนี้
① Prompt กว้างเกินไป
② มีคำสั่งหลายอย่างแต่ไม่ได้บอกว่าอะไรสำคัญที่สุด
③ ไม่ระบุสิ่งที่ห้ามเปลี่ยน
④ ตำแหน่งวัตถุไม่ชัด
⑤ Style ไม่ชัด
⑥ ใช้คำที่ตีความได้หลายแบบ
⑦ Reference Image ไม่ชัด
⑧ แก้หลายอย่างพร้อมกัน
⑨ สั่งงานต่อจากภาพที่เริ่มเพี้ยนแล้ว
⑩ คาดหวัง Pixel-perfect จาก Generative AI
การแก้จึงต้องเริ่มที่โครงสร้าง Prompt ก่อน
ตัวอย่าง Prompt
“สร้างผู้ชายเท่ ๆ”
คำว่า “เท่” สามารถหมายถึง
เสื้อผ้าสตรีท
สูท
นักกีฬา
มอเตอร์ไซค์
แฟชั่นเกาหลี
Luxury
Cyberpunk
Gemini จึงต้องตัดสินใจแทนคุณหลายอย่าง
ควรเปลี่ยนเป็น
“สร้างภาพผู้ชายอายุประมาณ 30 ปี ใส่สูทสีกรมท่า เสื้อเชิ้ตสีขาว ยืนในสำนักงาน Modern Minimal มองกล้องตรง ใช้ Soft Natural Lighting สไตล์ Professional Business Portrait”
Prompt ใหม่กำหนดรายละเอียดมากกว่าอย่างชัดเจน
ใช้โครงสร้างนี้
Subject + Action + Environment + Composition + Style + Lighting + Details + Restrictions
ตัวอย่าง
“สร้างภาพผู้หญิงกำลังนั่งทำงานกับ Laptop ในร้านกาแฟ Modern Minimal นั่งอยู่ด้านขวาของ Frame เว้นพื้นที่ว่างด้านซ้ายประมาณ 40% สำหรับข้อความ ใช้ Soft Morning Light สไตล์ Photorealistic รักษาสัดส่วนร่างกายตามธรรมชาติ ไม่มีข้อความ ไม่มี Logo และไม่มีคนอื่นในฉาก”
Prompt แบบนี้บอก Gemini ทั้ง
ใคร
ทำอะไร
อยู่ที่ไหน
วางตรงไหน
ภาพแบบไหน
แสงแบบไหน
อะไรที่ไม่ต้องการ
อย่าเขียนเพียง
“สร้างรถสวย ๆ”
ควรบอก
ประเภท
สี
มุม
สภาพแวดล้อม
Style
ตัวอย่าง
“สร้างรถสปอร์ต Coupe สีดำด้าน มุมกล้อง Front Three-quarter View จอดบนถนนในโตเกียวตอนกลางคืน มี Neon Reflection บนถนนเปียก สไตล์ Photorealistic”
ยิ่ง Subject ชัด AI ยิ่งมีพื้นที่เดาน้อยลง
คำว่า
“สร้างผู้หญิงในร้านกาแฟ”
ยังเปิดกว้างมาก
อาจได้
ยืน
นั่ง
เดิน
ถือกาแฟ
มองหน้ากล้อง
ถ้าต้องการเฉพาะเจาะจงให้บอก
“ผู้หญิงนั่งอยู่บนเก้าอี้ริมหน้าต่าง มือขวาถือแก้วกาแฟ มือซ้ายวางบน Laptop และมองออกนอกหน้าต่าง”
สิ่งนี้เรียกว่า Action หรือ Pose Description
Background มีผลต่อ Mood ของภาพมาก
แทนที่จะเขียน
“อยู่ในสำนักงาน”
ลองใช้
“อยู่ในสำนักงาน Modern Minimal ผนังสีขาว โต๊ะไม้ กระจกบานใหญ่ มีแสงธรรมชาติและต้นไม้สีเขียวเล็กน้อย Background สะอาด”
Gemini จะมีข้อมูลสำหรับสร้าง Scene มากขึ้น
ถ้าต้องการคนอยู่ด้านขวา อย่าเขียนเพียง
“มีพื้นที่สำหรับข้อความ”
ควรเขียน
“วางบุคคลไว้ใน Right Third ของ Frame และเว้น Negative Space ทางซ้ายประมาณ 40% สำหรับ Headline”
หรือ
“สินค้าอยู่ตรงกึ่งกลางด้านล่าง”
“Logo อยู่มุมซ้ายบน”
“ข้อความอยู่กึ่งกลางด้านบน”
คำสั่งเชิงตำแหน่งช่วยลด Layout ที่ผิดจาก Intent
“สร้างภาพโฆษณาสมาร์ตโฟนแนวนอน 16:9 วางสินค้าไว้ใน Right Third ของ Frame เว้นพื้นที่ด้านซ้ายประมาณ 40% เป็น Negative Space สำหรับข้อความ ใช้ Background สีดำและ Blue Glow ห้ามวางวัตถุสำคัญในพื้นที่ด้านซ้าย”
หากต้องการภาพสมจริง การบอก Camera Angle ช่วยได้มาก
ตัวอย่าง
Eye-level
Low Angle
High Angle
Top-down
Close-up
Medium Shot
Wide Shot
Over-the-shoulder
Front View
Side View
Three-quarter View
ตัวอย่าง Prompt
“สร้างภาพผู้ชายยืนหน้าตึก ใช้ Low-angle Camera Shot มองขึ้นเล็กน้อย ให้บุคคลดูโดดเด่น”
ตัวอย่าง
เน้นใบหน้า
ประมาณเอวขึ้นไป
เห็นทั้งตัว
เห็น Scene โดยรอบ
หาก Prompt บอกเพียง “Portrait” Gemini อาจเลือก Crop ต่างจากที่คุณต้องการ
Lighting สามารถเปลี่ยนภาพไปคนละอารมณ์ได้
ตัวอย่าง
Soft Natural Light
Golden Hour
Studio Lighting
Dramatic Lighting
Neon Lighting
Rim Light
Window Light
Cloudy Day
ตัวอย่าง
“ใช้ Soft Window Light จากด้านซ้ายของใบหน้า ให้ Shadow นุ่มและ Skin Tone เป็นธรรมชาติ”
ดีกว่า
“แสงสวย ๆ”
Google แนะนำให้ Prompt ระบุ Style ของภาพ เช่น Photorealistic, Charcoal Drawing, Watercolor Painting หรือ Cartoon Illustration พร้อม Visual Description ที่ละเอียด
ตัวอย่าง Style ที่ใช้ได้
Photorealistic
Cinematic
Anime
3D
Watercolor
Flat Illustration
Editorial Photography
Product Photography
Minimal
Luxury
Cyberpunk
อย่าใส่ Style หลายแบบที่ขัดกันโดยไม่มีเหตุผล
เช่น
“Photorealistic flat cartoon watercolor 3D”
เพราะ AI ไม่รู้ว่าอะไรควรเป็น Style หลัก
นี่เป็นเทคนิคสำคัญมาก
Prompt ที่ดีไม่ได้บอกแค่สิ่งที่ต้องมี
แต่บอกสิ่งที่ ห้ามมี
ตัวอย่าง
“ไม่มีข้อความ”
“ไม่มี Logo”
“ไม่มีคนอื่น”
“ห้ามเปลี่ยนใบหน้า”
“ห้ามเปลี่ยนเสื้อ”
“อย่า Crop ศีรษะ”
“ห้ามเพิ่มสินค้าอื่น”
“อย่าเปลี่ยน Background”
ช่วยลดการสร้างรายละเอียดที่ไม่ต้องการ
ใช้โครงสร้าง
Preserve X + Change Only Y
ตัวอย่าง
“รักษาใบหน้า ทรงผม รูปร่าง เสื้อผ้า Pose, Lighting และ Background เดิมทั้งหมด เปลี่ยนเฉพาะสีเสื้อจากสีขาวเป็นสีดำ”
นี่เหมาะกับ Nano Banana 2 เพราะ Google ระบุว่ารองรับ Local Edits หรือการแก้ไขเฉพาะส่วนของภาพ
สมมติมีรูปคนหนึ่ง
ต้องการ
เปลี่ยนเสื้อ
เปลี่ยนผม
เปลี่ยน Background
เปลี่ยน Pose
เพิ่มแว่น
อย่าสั่งทั้งหมดใน Prompt เดียวก่อนถ้า Identity สำคัญ
ควรทำ
รอบ 1 → เปลี่ยนเสื้อ
รอบ 2 → เปลี่ยน Background
รอบ 3 → เพิ่มแว่น
รอบ 4 → ตรวจหน้า
การ Edit ทีละส่วนช่วยให้รู้ว่าจุดไหนทำให้ภาพเริ่มผิด
ปัญหานี้พบได้บ่อยเวลาแก้รูปคน
ให้ใช้ Prompt ที่ล็อก Facial Identity
ตัวอย่าง
“Preserve the original facial identity exactly as closely as possible. Do not alter the eyes, eyebrows, nose, lips, jawline, face shape, skin tone, age or hairstyle. Change only the clothing.”
หรือภาษาไทย
“รักษาใบหน้าเดิมให้ใกล้เคียงต้นฉบับมากที่สุด ห้ามเปลี่ยนดวงตา คิ้ว จมูก ริมฝีปาก รูปหน้า สีผิว อายุ และทรงผม เปลี่ยนเฉพาะเสื้อผ้า”
Nano Banana 2 มี Character Consistency ซึ่ง Google ระบุว่าช่วยรักษารูปลักษณ์ของบุคคลหรือตัวละครข้ามภาพได้
คำว่า
“หน้าเดิม”
อาจไม่ละเอียดพอ
ให้ระบุ Facial Features ที่ไม่ต้องเปลี่ยน
เช่น
eyes
nose
lips
jawline
face shape
skin tone
age
ยิ่ง Identity สำคัญ ยิ่งควรระบุ
ถ้าคุณต้องการ
คนเดิม
สินค้าเดิม
เสื้อเดิม
สถานที่เดิม
การ Upload Reference ดีกว่าพยายามอธิบายทุกอย่างเป็นข้อความ
Nano Banana 2 รองรับ Multiple Reference Images โดย Google ระบุว่าสามารถใช้หลายภาพเพื่อผสม Scene หรือ Idea และรักษา Character Consistency ได้
ภาพ 1 = คน
ภาพ 2 = เสื้อ
ภาพ 3 = Background
Prompt
“ใช้บุคคลจากภาพที่ 1 เป็นตัวแบบหลัก ใช้เสื้อจากภาพที่ 2 และใช้สถานที่จากภาพที่ 3 เป็น Background รักษา Facial Identity ของบุคคลจากภาพที่ 1 และอย่า Blend ใบหน้ากับองค์ประกอบจาก Reference อื่น”
วิธีนี้ชัดกว่าการเขียน
“ทำให้เหมือนรูปที่ให้”
ถ้าอัปโหลดหลายภาพ ควรอธิบายหน้าที่
Reference 1 = Face
Reference 2 = Clothing
Reference 3 = Background
Reference 4 = Lighting
Reference 5 = Pose
แล้วจึงสั่ง
“Use Reference 1 only for identity, Reference 2 only for clothing and Reference 3 only for environment.”
ช่วยลดการที่ AI เอาองค์ประกอบผิดรูปมาใช้
Prompt ที่ไม่ดี
“เปลี่ยนเป็นเสื้อดำ”
Prompt ที่ดีกว่า
“รักษาบุคคล ใบหน้า ทรงผม Pose, Background, Camera Angle และ Lighting เดิมทั้งหมด เปลี่ยนเฉพาะเสื้อสีขาวเป็นเสื้อเชิ้ตสีดำทรงเดิม รักษารอยพับและ Shadow ให้สัมพันธ์กับภาพเดิม”
Keyword สำคัญคือ
Change only
ใช้ Prompt
“รักษาบุคคลทั้งหมดเหมือนต้นฉบับ รวมถึงใบหน้า ทรงผม เสื้อผ้า Pose, body proportions และ Camera Perspective เปลี่ยนเฉพาะ Background เป็นสำนักงาน Modern Minimal และปรับเฉพาะ Lighting ที่จำเป็นเพื่อให้เข้ากับฉากใหม่”
อย่าเขียนเพียง
“ลบคนนี้”
ควรระบุว่าให้เติมฉากต่อเนื่องด้วย
“ลบผู้ชายที่อยู่ด้านหลังทางขวาออก เติมพื้นที่ Background ที่หายไปให้ต่อเนื่องกับผนังและพื้นเดิม รักษาบุคคลหลักและวัตถุอื่นไว้ทั้งหมด”
Prompt
“เพิ่มแก้วกาแฟสีขาวบนโต๊ะด้านซ้ายของ Laptop วางห่างจาก Laptop ประมาณเล็กน้อย ให้ Perspective, Scale, Lighting และ Shadow สอดคล้องกับวัตถุในภาพเดิม”
ระบุ Relative Position จะช่วยมากกว่า
“เพิ่มแก้วบนโต๊ะ”
ระบุชื่อสีให้ชัดขึ้น
แทน
“สีน้ำเงิน”
ใช้
“Dark Navy Blue”
หรือถ้าเป็นงาน Concept สามารถเพิ่ม Hex Code เพื่อสื่อเจตนา เช่น
“ใช้สีประมาณ #0B1F3A”
อย่างไรก็ตาม AI Image Generation ไม่ใช่ระบบ Color Management แบบแม่นยำระดับงาน Print จึงควรตรวจสี Final อีกครั้ง
ควรระบุทั้ง Ratio และ Use Case
ตัวอย่าง
“สร้างภาพแนวนอน 16:9 สำหรับ YouTube Thumbnail”
“สร้างภาพแนวตั้ง 9:16 สำหรับ Instagram Story”
“สร้างภาพ 1:1 สำหรับ Social Media Post”
Nano Banana 2 รองรับการสร้างและแก้ภาพหลาย Aspect Ratio และฝั่ง Developer ของ Google ยังเพิ่ม Native Aspect Ratios หลายแบบเพื่อเพิ่ม Creative Control
ถ้าต้องการขยายพื้นที่ Background ให้พูดว่า
“Extend the canvas to the left while keeping the subject unchanged.”
ไม่ใช่
“Make the image wider.”
เพราะคำหลังอาจถูกตีความว่าให้ยืดหรือ Recompose ทั้งภาพ
Nano Banana 2 มี Better Text Rendering แต่ยังควรให้ข้อความตรงตัว
ตัวอย่างที่ดี
“ใส่ข้อความภาษาไทยว่า ‘โปรโมชั่นพิเศษ’ ตรงตามตัวอักษร ห้ามแก้คำ ห้ามแปล และห้ามเพิ่มข้อความอื่น”
หากผิด ให้แก้เฉพาะข้อความ
“รักษาภาพเดิมทั้งหมด เปลี่ยนเฉพาะข้อความจาก ‘โปรโมชันพิเสด’ เป็น ‘โปรโมชั่นพิเศษ’”
แบ่งงานเป็น 2 ขั้น
ให้ Gemini ช่วยสรุปข้อความเป็น Structure ก่อน
เช่น
Headline
Section 1
Section 2
Section 3
ใช้ข้อมูล Final ไปสร้าง Infographic
อย่าให้ AI
ค้นข้อมูล
ตัดสินว่าอะไรสำคัญ
เขียนข้อความ
ออกแบบ Layout
ทั้งหมดในคำสั่งเดียวถ้าความถูกต้องมีความสำคัญสูง
แม้ Nano Banana 2 จะมี Improved World Knowledge สำหรับ Diagram และ Infographic แต่ Google ก็แนะนำให้ใช้วิจารณญาณก่อนพึ่งพาหรือเผยแพร่ Content ที่สร้างขึ้น
ให้กำหนด Visual Hierarchy
ตัวอย่าง
“โปสเตอร์แนวตั้ง 4:5
Headline อยู่ด้านบน กินพื้นที่ประมาณ 20%
Hero Product อยู่ตรงกลางประมาณ 55%
CTA อยู่ด้านล่างประมาณ 15%
มี Margin รอบขอบ
ห้ามวางข้อความทับสินค้า”
การแบ่งพื้นที่เป็นสัดส่วนช่วยให้ AI เข้าใจ Layout ได้มากขึ้น
Prompt ที่ดีควรบอก
Ratio
Hero
Text Area
Expression
Background
Contrast
ตัวอย่าง
“สร้าง YouTube Thumbnail 16:9 มีผู้ชายสีหน้าตกใจอยู่ด้านขวา กินพื้นที่ประมาณ 45% ของภาพ เว้นพื้นที่ด้านซ้ายสำหรับข้อความขนาดใหญ่ Background เป็น AI Technology สีม่วงและน้ำเงิน ใช้ Contrast สูง ไม่มีข้อความในภาพ”
ถ้าสินค้าต้องตรงจริง อย่าสร้าง Product จาก Text ใหม่ทั้งหมด
ให้อัปโหลดภาพสินค้าจริง
Prompt
“ใช้สินค้าในภาพ Reference เป็นต้นฉบับหลัก รักษา Shape, Logo, Label, Packaging, Number of Buttons, Color และ Product Proportions เดิม เปลี่ยนเฉพาะ Background และ Lighting”
หลังสร้างต้องตรวจ
Logo
ฉลาก
พอร์ต
จำนวนปุ่ม
สี
รูปทรง
อีกครั้ง
สมมติต้องการ Poster ข้อความว่า
“ลดสูงสุด 50%”
อย่าเขียนว่า
“ช่วยคิดโปรโมชั่นแล้วใส่ลงภาพ”
ถ้าคุณต้องการคำนี้แน่นอน
ให้ส่งคำนี้ตรง ๆ
ยิ่ง Gemini ต้องตัดสินใจแทนคุณน้อยเท่าไร ผลยิ่งตรง Intent มากขึ้น
ถ้ามีหลาย Requirement สามารถเขียนแบบ
Priority 1: รักษาใบหน้าเดิม
Priority 2: เปลี่ยนเสื้อเป็นสีดำ
Priority 3: เปลี่ยน Background
Priority 4: เพิ่ม Soft Lighting
ช่วยบอกว่า หากต้อง Trade-off อะไร Identity ต้องสำคัญที่สุด
Prompt ซับซ้อนสามารถเขียนแบบนี้
Subject:
ผู้ชายจาก Reference
Preserve:
Face, hair, body proportions
Change:
Clothing only
Clothing:
Dark navy suit
Background:
Modern office
Lighting:
Soft window light
Do not change:
Face, pose, camera angle
การแบ่งหมวดทำให้อ่านและแก้ Prompt ได้ง่ายกว่าประโยคยาวบรรทัดเดียว
“Create a [STYLE] image of [SUBJECT] [ACTION] in [ENVIRONMENT].
Composition: [POSITION / CAMERA / ASPECT RATIO]
Lighting: [LIGHTING]
Colors: [COLOR PALETTE]
Important details: [DETAILS]
Do not include: [RESTRICTIONS].”
“Use the uploaded image as the master reference.
Preserve:
[LIST EVERYTHING THAT MUST REMAIN]
Change only:
[ONE TARGET]
New result:
[EXACT DESCRIPTION]
Do not alter:
[IDENTITY / BACKGROUND / POSE / LIGHTING / PRODUCT ETC.]”
“Use the uploaded photo as the master identity reference. Preserve the person’s facial identity, eyes, eyebrows, nose, lips, jawline, face shape, skin tone, hairstyle, age and body proportions. Change only the clothing to a dark navy business suit. Keep the pose, camera angle, background and lighting unchanged.”
“Use the uploaded product as the exact master reference. Preserve its shape, proportions, logo, label, packaging, color and physical details. Do not redesign the product. Change only the environment to a premium studio with a black background and soft rim lighting.”
“Preserve the person, face, hairstyle, clothing, pose, body proportions and camera angle from the original image. Change only the background to a modern office with large windows and soft natural light. Adjust lighting minimally to integrate the subject naturally.”
“Remove only the red car behind the main subject. Reconstruct the missing road and background naturally. Preserve the main person, buildings, lighting, shadows, perspective and all other objects.”
“Recompose this image to 16:9. Keep the person unchanged and place them on the right third of the frame. Extend the background naturally to the left and leave approximately 40% negative space for headline placement. Do not crop the head or body.”
อย่าเขียน Prompt ใหม่หมดทันที
ให้บอก Gemini ว่าอะไรผิด
ตัวอย่าง
“ภาพโดยรวมถูกต้องแล้ว แต่สินค้าควรอยู่ด้านขวามากกว่านี้ รักษาทุกอย่างเดิมและย้ายเฉพาะสินค้าไปทางขวา”
นี่ใช้ประโยชน์จาก Conversational Editing ได้ดีกว่า Generate ใหม่ทั้งหมด
ยังไม่ดีที่สุด
ควรระบุว่าสิ่งสำคัญคืออะไร
เช่น
“รักษาใบหน้า ทรงผม เสื้อผ้า Pose, Camera Angle, Background และ Lighting เดิม”
เพราะคำว่า
“ทุกอย่างเดิม”
ยังเปิดให้โมเดลตีความ
สมมติ
Version 1 → หน้าถูก
Version 2 → หน้าเปลี่ยนเล็กน้อย
Version 3 → หน้าเปลี่ยนมากขึ้น
อย่าใช้ Version 3 เป็นฐานต่อ
ให้กลับไป Version 1
แล้วแก้ใหม่
เพราะ Generative Editing หลายรอบสามารถเกิด Identity Drift
แม้ Nano Banana 2 จะมี Character Consistency ที่ได้รับการปรับปรุงแล้วก็ตาม
ควรเก็บ
Original
Master Reference
Best Version
Final
แยกกัน
อย่า Save ทับ
เมื่อภาพเริ่มเพี้ยนสามารถย้อนกลับไปยัง Master ได้
Google ระบุว่า Nano Banana 2 Lite เน้น ความเร็วและไอเดียพื้นฐาน และไม่ได้ออกแบบสำหรับ Multiple Reference Images หรือ Multiple Edits โดยเฉพาะ
ถ้างานเป็น
แก้รูปหลายรอบ
ใช้หลาย Reference
รักษาคน
งานรายละเอียดสูง
ควรใช้ Nano Banana 2 มากกว่า Lite เมื่อมีตัวเลือก
Google ระบุว่า Nano Banana 2 สมดุล
Speed
Higher Image Quality
World Knowledge
Reliable Text Rendering
และสามารถรับหลาย Reference Images ได้
ดังนั้นเหมาะมากกับการแก้ปัญหา
“ภาพไม่ตรง Prompt”
โดยเฉพาะเมื่อต้อง Iteration หลายรอบ
ถ้ามี Google AI Plan และงานต้องการรายละเอียดเพิ่ม สามารถใช้ Nano Banana Pro ใน Workflow ที่รองรับ
Google ระบุว่า Pro มี
World Knowledge สูงกว่า
Advanced Text/Language
Higher Consistency
More Precise Creative Control
จึงเหมาะกับ
Infographic
Poster
หลาย Reference
ข้อความเยอะ
Composition ซับซ้อน
แต่ Pro ก็ไม่ได้รับประกันว่าจะตรง 100% หาก Prompt ยังคลุมเครือ
สมมติ Prompt
“ทำรูปสวย ๆ”
แม้ใช้ Model ที่เก่งมาก ผลก็ยังเปิดกว้าง
แต่ Prompt
“วางสินค้าด้านขวา 35% เว้น Negative Space ซ้าย Background ดำ Soft Blue Rim Light ไม่มีข้อความ”
กำหนด Intent ได้มากกว่า
ดังนั้นลำดับควรเป็น
แก้ Prompt ก่อน → เลือก Model ให้เหมาะทีหลัง
ตัวอย่าง
“สวย หรู เท่ Premium Luxury Amazing Stunning Best Quality Perfect”
ไม่ได้ช่วยบอก Composition เท่ากับ
“Black marble pedestal, controlled golden rim lighting, clean negative space, symmetrical product composition”
ใช้รายละเอียด Visual แทนคำชมเชิงนามธรรม
“ทำภาพสวย ๆ”
“กลางวันมืดสนิทแต่ไม่มีแสงและสว่างมาก”
สร้าง + แก้ + เขียนข้อความ + 10 Reference + 5 Version ในครั้งเดียว
ไม่รู้ว่าอะไรต้องรักษา
AI เพิ่มของเอง
AI เลือก Layout เองทั้งหมด
ถ้าภาพไม่ตรง ให้แยก Prompt
คนหรือสิ่งของถูกไหม
ตำแหน่งถูกไหม
รูปแบบถูกไหม
แสงถูกไหม
รายละเอียดถูกไหม
ข้อความถูกไหม
เปลี่ยน ทีละ Variable
จะรู้ว่าอะไรทำให้ภาพผิด
Prompt แรก
“สร้างผู้หญิงในร้านกาแฟ”
ปัญหา: ยืนแทนนั่ง
แก้เป็น
“ผู้หญิงนั่งบนเก้าอี้”
ปัญหา: อยู่กลางภาพ
เพิ่ม
“วางผู้หญิงด้านขวา”
ปัญหา: Background รก
เพิ่ม
“Background Minimal และเว้น Negative Space ซ้าย”
วิธีนี้ดีกว่าพยายามเขียน Prompt 300 คำตั้งแต่ครั้งแรก
ใช้วงจร
Generate → Inspect → Identify One Problem → Edit One Problem → Inspect Again
นี่เหมาะกับ Nano Banana 2 มาก เพราะ Local Edits และ Enhanced Instruction Following ถูกออกแบบมาสำหรับการแก้ภาพต่อเนื่อง
ตรงหรือยัง
ทำสิ่งที่ต้องการหรือไม่
ถูกหรือไม่
อยู่ตำแหน่งถูกหรือไม่
มุมถูกหรือไม่
ตรงหรือไม่
ตรง Mood หรือไม่
ตรงหรือไม่
ถูกหรือไม่
สะกดถูกไหม
Identity เปลี่ยนหรือไม่
รายละเอียดเปลี่ยนไหม
มีของที่ไม่ได้ขอหรือไม่
มีพื้นที่ตามต้องการไหม
ถ้า Gemini สร้างไม่ตรง Prompt ให้ใช้
บอกให้ชัด + ล็อกสิ่งเดิม + เปลี่ยนทีละอย่าง + ระบุตำแหน่ง + ห้ามสิ่งไม่ต้องการ
หรือเขียนเป็นสูตร
WHAT + WHERE + HOW + PRESERVE + CHANGE ONLY + DO NOT
“ทำรูปนี้ให้ดูมืออาชีพ”
กว้างเกินไป
“รักษาบุคคล ใบหน้า เสื้อผ้าและ Pose เดิม เปลี่ยนเฉพาะ Background เป็นสำนักงาน Modern Minimal ใช้ Soft Window Lighting เพิ่ม Contrast เล็กน้อย และรักษา Skin Tone ให้เป็นธรรมชาติ”
“ทำรูปสินค้าให้สวย”
“รักษาสินค้า Shape, Logo, Label, Packaging และ Color เดิม วางสินค้าบนแท่นหินสีดำ ใช้ Soft Studio Lighting และ Background สีดำ Gradient ห้ามเพิ่มสินค้าอื่นหรือข้อความ”
“ทำปก YouTube”
“สร้าง YouTube Thumbnail 16:9 มีผู้ชายอยู่ด้านขวาของ Frame สีหน้าตื่นเต้น เว้นพื้นที่ซ้ายประมาณ 40% สำหรับ Headline ใช้ Background Technology สีม่วงและน้ำเงิน Contrast สูง ไม่มีข้อความ”
เพราะ Prompt อาจคลุมเครือ มีหลายเงื่อนไข หรือไม่ได้กำหนด Priority และข้อจำกัด แม้ Nano Banana 2 จะมี Enhanced Instruction Following สำหรับคำสั่งที่ซับซ้อนขึ้น แต่ผลลัพธ์ Generative ยังมีความแปรผันได้
ระบุ Subject, Action, Background, Composition, Style, Lighting และ Restrictions ให้ชัด พร้อมบอกสิ่งที่ต้องรักษาและสิ่งที่ต้องเปลี่ยน
Generative Model อาจสร้างรายละเอียดอื่นใหม่ระหว่าง Edit ควรใช้คำสั่ง Preserve Facial Identity และ Change Only Clothing พร้อม Reference ต้นฉบับ
Nano Banana 2 มี Character Consistency สำหรับช่วยรักษารูปลักษณ์ของบุคคลหรือตัวละครข้ามภาพ แต่ไม่ควรคาดหวัง Pixel-perfect 100% ทุกครั้ง
ควร โดยเฉพาะเมื่อ Identity, Product, Clothing หรือ Style ต้องตรง Nano Banana 2 รองรับ Multiple Reference Images
ไม่จำเป็น Prompt ที่ยาวแต่ขัดแย้งกันอาจแย่กว่า Prompt สั้นที่มี Structure ชัด ควรเน้นข้อมูลที่มีผลต่อภาพจริง
ถ้า Identity หรือรายละเอียดสำคัญ ควรแก้ทีละส่วน เพื่อลดความผิดพลาดและรู้ว่าส่วนใดทำให้ภาพเพี้ยน
Google ระบุว่า Pro มี Higher Consistency และ More Precise Creative Control จึงช่วยงานซับซ้อนได้ แต่ Prompt ที่ชัดยังคงสำคัญมาก
ใส่ข้อความตรงตัวในเครื่องหมายคำพูด สั่งห้ามแก้หรือเพิ่มข้อความ และหากผิดให้ใช้ Local Edit แก้เฉพาะข้อความ
ย้อนกลับไปยัง Original หรือ Master Version ที่ยังถูกต้อง แล้วเริ่ม Edit จุดที่ต้องการใหม่ แทนการ Edit ต่อจากภาพที่เพี้ยนแล้ว
หาก Gemini สร้างภาพไม่ตรง Prompt สิ่งสำคัญที่สุดคือ อย่ากด Generate ใหม่แบบเดิมซ้ำไปเรื่อย ๆ
เพราะหาก Prompt ยังคลุมเครือ ผลลัพธ์แต่ละครั้งก็ยังสามารถแตกต่างไปในทิศทางที่คุณไม่ต้องการ
ให้ใช้หลัก
① ระบุ Subject ให้ชัด
② บอก Action
③ กำหนด Background
④ ระบุตำแหน่งและ Composition
⑤ เลือก Style
⑥ กำหนด Lighting
⑦ บอกสิ่งที่ต้องรักษา
⑧ บอกสิ่งที่ต้องเปลี่ยน
⑨ บอกสิ่งที่ห้ามเกิด
⑩ แก้ทีละส่วน
Google ระบุว่า Nano Banana 2 มี Enhanced Instruction Following, Character Consistency, Local Edits และ Multiple Reference Images ซึ่งทำให้สามารถควบคุมการสร้างและแก้ภาพได้ดีขึ้นเมื่อ Prompt มีรายละเอียดชัดเจน
สูตรที่ควรจำคือ
Subject + Action + Environment + Composition + Style + Lighting + Preserve + Change Only + Restrictions
และสำหรับการแก้รูป ใช้สูตรที่สำคัญที่สุดคือ
Preserve X → Change Only Y
เช่น
“รักษาใบหน้า ทรงผม เสื้อผ้า Pose และ Background เดิมทั้งหมด เปลี่ยนเฉพาะสีเสื้อเป็นสีดำ”
ถ้าผลลัพธ์ยังผิด อย่าสร้างใหม่ทั้งภาพทันที แต่ให้บอก Gemini ว่า
“ภาพส่วนอื่นถูกต้องแล้ว แก้เฉพาะจุดนี้”
วิธีนี้ใช้ประโยชน์จาก Local Editing ของ Nano Banana 2 ได้เต็มที่ และลดโอกาสที่สิ่งซึ่งถูกต้องอยู่แล้วจะเปลี่ยนตามไปด้วย
สุดท้าย หากเป็นงานสำคัญ เช่น รูปบุคคลจริง ภาพสินค้า Logo ราคา หรือข้อความโฆษณา ต้องตรวจ Output ทุกครั้ง เพราะแม้โมเดลจะได้รับการปรับปรุงให้ทำตามคำสั่งได้ดีขึ้น แต่ Generative AI ยังไม่ใช่ระบบ Pixel-perfect ที่รับประกันรายละเอียดทุกจุด 100%
แนวทางที่ดีที่สุดจึงไม่ใช่การพยายามหา “Prompt วิเศษ” เพียงประโยคเดียว แต่คือ
สร้าง → ตรวจ → ระบุจุดผิด → แก้เฉพาะจุด → ตรวจอีกครั้ง
เมื่อใช้ Workflow นี้ Gemini จะสร้างภาพตรง Prompt และตรง Intent ได้มากกว่าการ Generate ใหม่แบบสุ่มอย่างชัดเจน