Google Gemini (สร้างภาพด้วย Imagen 4) คือหนึ่งใน AI สร้างภาพที่ได้รับความสนใจมากที่สุด ณ เดือนสิงหาคม 2025 ด้วยการผสานโมเดลสร้างข้อความ Gemini 2.5 (Pro / Flash) เข้ากับแบ็กเอนด์สร้างภาพ Imagen 4 ทำให้สามารถสร้างภาพคุณภาพสูงผ่านการสนทนาอย่างเป็นธรรมชาติได้
บทความนี้จะอธิบายอย่างครอบคลุม ตั้งแต่ความเข้าใจพื้นฐาน กลไกการทำงาน วิธีใช้ ตัวอย่างการใช้งาน ไปจนถึงข้อควรระวัง เพื่อให้ผู้เริ่มต้นจนถึงระดับกลางนำไปใช้งานจริงได้ทันที
ข่าว: โมเดลโค้ดเนม "nano banana" เปิดตัวในชื่อ "Gemini 2.5 Flash Image Preview" – วิวัฒนาการครั้งใหม่ของ AI สร้างภาพ (27/8/2025)
การสร้างภาพด้วย Gemini คืออะไร? ความเข้าใจพื้นฐาน
ภาพรวมของ Google Gemini และตำแหน่งของ Imagen 4
Google Gemini (สร้างภาพด้วย Imagen 4) คือระบบ AI แบบมัลติโมดัลที่พัฒนาโดย Google โดย Gemini 2.5 (Pro หรือ Flash) ซึ่งรับหน้าที่สร้างข้อความ ทำงานประสานกับ Imagen 4 เอนจินเฉพาะทางด้านการสร้างภาพ เพื่อสร้างภาพคุณภาพสูงผ่านการสนทนาอย่างเป็นธรรมชาติ
ณ เดือนสิงหาคม 2025 Imagen 4 มีคุณภาพการสร้างตัวอักษรที่พัฒนาขึ้นอย่างมากเมื่อเทียบกับ Imagen 3 รุ่นก่อน โดยเฉพาะการวาดตัวอักษรภายในภาพที่ปรับปรุงแบบก้าวกระโดด รองรับความละเอียด 2K สูงสุด 2048×2048 พิกเซล และทำความเร็วได้สูงสุดถึง 10 เท่าของเวอร์ชันก่อนหน้า
ความแตกต่างและจุดได้เปรียบเหนือบริการของเจ้าอื่น
จุดเด่นที่สุดของการสร้างภาพด้วย Gemini คือการสร้างภาพแบบโต้ตอบซ้ำ ๆ ผ่านบทสนทนา ขณะที่ DALL-E 3 ของ ChatGPT หรือ Midjourney สร้างภาพจากคำสั่งครั้งเดียว Gemini สามารถปรับแต่งภาพทีละขั้นตอนผ่านการสนทนาได้
อย่างที่กล่าวถึงในบทความด้านล่างนี้ Gemini สามารถสร้างภาพที่ดูเป็นธรรมชาติอย่างมากได้
[มือใหม่ด้าน AI ก็ใช้ได้จริง] รวมรายชื่อบริการและเครื่องมือ AI สร้างภาพ [ฉบับสิงหาคม 2025]
เปรียบเทียบกับคู่แข่งหลัก:
| บริการ | จุดแข็ง | ฉากการใช้งานที่เหมาะสม |
|---|---|---|
| Gemini + Imagen 4 | ปรับแต่งผ่านบทสนทนา รองรับภาษาญี่ปุ่น คุ้มค่าใช้จ่าย | งานสร้างสรรค์แบบทำซ้ำ งานธุรกิจ |
| Midjourney | คุณภาพเชิงศิลปะ | งานศิลปะคุณภาพสูง |
| ChatGPT (4o) | ความแม่นยำในโลกภาษาอังกฤษ | งานที่เชื่อมโยงกับข้อความ |
ข้อจำกัดการใช้งานฟรีและจุดเด่น
เสน่ห์ของการสร้างภาพด้วย Gemini คือแม้ผู้ใช้ฟรีก็สร้างภาพคุณภาพสูงได้ ในเวอร์ชันฟรีมีข้อจำกัดจำนวนครั้งการใช้งานต่อวัน แต่ไม่มีการระบุเพดานที่แน่ชัด โดยทั่วไปถือว่าเพียงพอต่อการใช้งานในชีวิตประจำวัน และแม้ใช้ถึงขีดจำกัดแล้ว หากรอสักพักก็จะกลับมาใช้ได้อีกครั้ง
วิธีสร้างภาพด้วย Gemini
วิธีใช้งานพื้นฐาน
ล็อกอินด้วยบัญชี Google
เปิดเบราว์เซอร์ไปที่ gemini.google.com แล้วลงชื่อเข้าใช้ด้วยบัญชี Google ของคุณ
ป้อนพรอมต์

ในหน้าจอแชทที่แสดงขึ้นหลังล็อกอิน ให้พิมพ์คำสั่งสร้างภาพที่เจาะจงลงในช่องป้อนข้อความ
สร้างภาพ
คลิกปุ่มส่งข้อความ AI จะสร้างภาพต้นฉบับให้ภายในไม่กี่วินาทีถึงหลายสิบวินาที
บันทึกภาพ

คลิกปุ่ม "ดาวน์โหลด" ที่อยู่ใต้ภาพที่สร้างขึ้นเพื่อบันทึกภาพ หากใช้สมาร์ตโฟน สามารถกดค้างที่ภาพเพื่อบันทึกได้เช่นกัน
เคล็ดลับการเขียนพรอมต์
การจะได้ภาพที่มีประสิทธิภาพ การบรรยายอย่างเจาะจงเป็นสิ่งสำคัญ ตัวอย่างเช่น:
พรอมต์
คืนงานเทศกาลฤดูร้อน หญิงสาวชาวญี่ปุ่นสวมชุดยูกาตะสีสันสดใสกำลังแหงนมองดอกไม้ไฟลูกใหญ่ที่กระจายเต็มท้องฟ้ายามค่ำคืน ผมเกล้ารวบอย่างเรียบร้อย บนชุดยูกาตะมีลวดลายดอกไม้ ฉากหลังเป็นริมแม่น้ำและโคมไฟกระดาษเรียงราย ท้องฟ้ายามค่ำคืนมีดอกไม้ไฟหลากสีส่องประกาย ภาพสไตล์ภาพถ่ายความละเอียดสูง บรรยากาศอบอุ่นและสมจริงราวกับอยู่ในเหตุการณ์
เนกาทีฟพรอมต์
ภาพเบลอ ความละเอียดต่ำ สีหน้าไม่เป็นธรรมชาติ แขนขาเกิน ใบหน้าผิดเพี้ยน ยูกาตะโปร่งแสง ข้อความหรือลายน้ำ แสงฟุ้งเกินจริง
เสน่ห์อยู่ที่การปรับแต่งพรอมต์ ซึ่งทำให้ได้ภาพหลากหลายตั้งแต่ภาพเรียบง่ายไปจนถึงองค์ประกอบซับซ้อน
ใช้ ChatGPT ช่วยเขียนพรอมต์
เมื่อต้องเขียนพรอมต์ยาว ๆ อย่างตัวอย่างข้างต้น ให้เข้า ChatGPT แล้วขอให้ช่วยเขียนพรอมต์ตามตัวอย่างด้านล่างนี้
ตัวอย่าง: ช่วยเขียนพรอมต์ภาษาญี่ปุ่นสำหรับสร้างภาพ "หญิงสาวชาวญี่ปุ่นกำลังชมดอกไม้ไฟ" ให้หน่อย
