เมนู

GPT Image 2

โมเดลภาพ native ของ OpenAI — ควบคุม prompt ได้ดี typography หลายภาษา และแก้ไขด้วยหลาย reference

4K HDตามพรอมป์ได้ทุกสไตล์ข้อความ + ภาพข้อความคมชัด
เริ่มสร้าง

ทำไม GPT Image 2 น่าใช้

ตัวอย่างจาก GPT Image 2 ของม้วนคัดอักษรจีนที่ได้แรงบันดาลใจจากต้นฉบับโบราณ เรนเดอร์บนกระดาษเก่าพร้อมตัวอักษรพู่กันแนวตั้งและตราประทับสีแดง

“สร้างโปสเตอร์พรีเมียมที่มีหัวเรื่องหลายภาษา หัวเรื่องรอง ข้อความสินค้า แ...”

จัดการตัวอักษรและข้อความซับซ้อนได้ดี

สำหรับโปสเตอร์ ปก แพ็กเกจจิ้ง UI หรืออินโฟกราฟิกที่มีข้อความแน่น GPT Image 2 มักรักษาหัวเรื่อง เนื้อความ ป้ายกำกับ และลำดับชั้นของหลายภาษาได้มั่นใจกว่า

โปสเตอร์ภาพยนตร์บนชานชาลารถไฟใต้ดินโตเกียวยามฝนตก มีชายและหญิงยืนเผชิญหน้ากันใต้ร่ม รถสายยามาโนะเตะกำลังเทียบชานชาลา ชื่อเรื่องภาษาญี่ปุ่นแนวตั้ง เครดิตนักแสดง โลเรลส์เทศกาล และบรรทัดวันฉายครบในภาพเดียว

“โปสเตอร์ภาพยนตร์รักดราม่าสไตล์ญี่ปุ่นอัตราส่วน 16:9 ชื่อเรื่อง 「最後の切符 / Saigo no Kippu」 ฉากเป็นชานชาลารถไฟใต้ดินโตเกียวในคืนฝนตก ด้านหน้าซ้ายมีคนสวมโค้ตสีเข้มยืนหันหลัง...”

ทำตามพรอมป์ได้หนักแน่นมาก

เมื่อภาพหนึ่งใบต้องคุมทั้งตัวแบบ เลย์เอาต์ ชุดสี จำนวนวัตถุ คำกำกับ และระบบตัวอักษรไปพร้อมกัน GPT Image 2 มักให้ผลที่เสถียรกว่า

ชีตออกแบบตัวละครอนิเมะพร้อมใช้งานจริง มีหัวข้อแปรงพู่กันขนาดใหญ่ ท่าฮีโร่ ภาพหลายมุม การ์ดอาวุธและความสามารถ ตารางสีหน้า โพลารอยด์เกร็ดสนุก และพาเนลท่าไม้ตาย จัดครบในเลย์เอาต์เดียว

“สร้างชีตคอนเซปต์ตัวละครที่ผสมเลย์เอาต์แบบคอลลาจ หัวข้อแบบลายมือ และ...”

ทำงานได้หลายแนวภาพ

ตั้งแต่ภาพถ่ายสมจริง เวกเตอร์เรียบ สีน้ำ อนิเมะ พิกเซลอาร์ต ไปจนถึงงานออกแบบระดับพรีเซนต์ โมเดลเดียวก็ข้ามหลายสไตล์ได้ดี

ลุคบุ๊กสินค้าลายดอกไม้สไตล์ห้างสรรพสินค้าญี่ปุ่น มีช่องสินค้า 4 ช่องสำหรับเดรส ผ้าพันคอ กระเป๋าโท้ต และพาวช์ พร้อมแถบแพตเทิร์นลายดอกไม้เต็มความกว้างด้านล่าง

“โปสเตอร์ lookbook สินค้าสไตล์ญี่ปุ่น พร้อมแผงสินค้าลายดอก 4 ช่อง, สวอตช์, คำบรรยาย และแถบแพตเทิร์นเต็มความกว้าง”

งานกราฟิกและ UI ระดับมืออาชีพ

สำหรับโปสเตอร์การตลาด ม็อกอัป UI แอป เลย์เอาต์แพ็กเกจจิ้ง สไลด์พรีเซนต์ และงานครีเอทีฟของแบรนด์ GPT Image 2 มักให้รอบแรกที่ใช้งานต่อได้จริงและพร้อมปรับละเอียดได้เร็ว

GPT Image 2 เทียบกับ Nano Banana 2

ทั้งสองโมเดลเก่ง แต่เด่นคนละงาน

GPT Image 2

ข้อความบนภาพ
ไว้ใจได้กว่าสำหรับหนังสือพิมพ์ โปสเตอร์ UI สูตร และเลย์เอาต์ที่มีข้อความเยอะ
กริด / แผนภูมิตัวอักษร
ทำตามกริด 100 ช่องและแผนภูมิ A-Z ที่มีกฎชัดเจนได้ดีกว่า
อินโฟกราฟิก / ภาพเชิงข้อมูล
มีวินัยเรื่องโครงสร้างและการจัดข้อมูลมากกว่า
ความคงที่ของตัวละคร
ใช้ภาพอ้างอิงหลายใบพร้อมมาสก์ได้ และนิ่งกับสตอรีบอร์ด 10 ช่อง
พอร์ตเทรต / วัสดุ
ถ้าระบุความสมจริงแบบภาพถ่ายให้ชัด คุณภาพวัสดุจะดีขึ้นมาก
การเลียนแบบสไตล์
มีโอกาสเบี่ยงออกจากสไตล์ต้นฉบับได้บ้าง
ขนาดและอัตราส่วน
มีอัตราส่วนสำเร็จรูปและโหมด auto

Nano Banana 2

ข้อความบนภาพ
มักดูสวยกว่า แต่ล้มง่ายกว่าเมื่อข้อความยาว
กริด / แผนภูมิตัวอักษร
บางครั้งข้ามช่องหรือรวมรายการเข้าด้วยกัน
อินโฟกราฟิก / ภาพเชิงข้อมูล
ภาพสวย แต่ความน่าเชื่อถือของข้อมูลไม่เสถียรเท่า
ความคงที่ของตัวละคร
ยืดหยุ่นกว่าหากต้องใช้ภาพอ้างอิงหลายใบพร้อมกัน
พอร์ตเทรต / วัสดุ
ให้ความรู้สึกเหมือนภาพถ่ายจริงได้ง่ายกว่าตั้งแต่ค่าเริ่มต้น
การเลียนแบบสไตล์
จับฝีแปรงต้นฉบับได้ดีกว่าเมื่อเปลี่ยนตัวแบบ
ขนาดและอัตราส่วน
มี 14 ตัวเลือก รวมถึงอัตราส่วนกว้างพิเศษ

ถ้าต้องการข้อความบนภาพ เลย์เอาต์หลายภาษา อินโฟกราฟิก โปสเตอร์ แพ็กเกจ หรือหน้าคอมิก ให้เลือก GPT Image 2 ถ้าอยากสำรวจสไตล์เร็วหรืออยากได้ความสมจริงตั้งแต่แรก ให้เลือก Nano Banana 2 เมื่อเทียบกับ GPT Image 1, GPT Image 2 ดีขึ้นชัดเจนด้านการทำตามพรอมป์ เลย์เอาต์ยาว และตัวอักษร 48+ ภาษา

สเปกโมเดล

สเปกทางเทคนิคสำหรับนักพัฒนาและผู้ใช้ขั้นสูง

โมเดล

GPT Image 2

โมเดลภาพหลายโมดัลแบบ autoregressive ที่ทรงพลังที่สุดของ OpenAI ในปี 2026

ความละเอียดสูงสุด

4K (ด้านยาวสูงสุด 3840)

เอาต์พุตโดยตรงจากโมเดลตั้งแต่ 1K ถึง 4K โดยด้านยาวสุดได้ถึง 3840 และพิกเซลรวมราว 8.29M

อัตราส่วนภาพ

อัตราส่วนสำเร็จรูป + auto

1:1 · 3:2 · 2:3 · 3:4 · 4:3 · 4:5 · 5:4 · 16:9 · 9:16 · 21:9 · auto; พื้นที่ทำงานปัจจุบันยังไม่รองรับขนาดกำหนดเองแบบอิสระ

เวลาในการสร้าง

10s - 60s

พรอมป์ที่ซับซ้อนอาจใช้เวลาราว 2 นาที

รูปแบบเอาต์พุต

WebP

ส่งออกเป็น WebP ตามค่าเริ่มต้นเพื่อสมดุลคุณภาพและขนาดไฟล์

ภาษาของข้อความ

48+ ภาษา

รองรับ CJK, อาหรับ, ฮีบรู, ซีริลลิก, ละติน และระบบตัวอักษรอื่น ๆ อีกมาก

โหมดแก้ไข

หลายภาพอ้างอิง + อินเพนต์ด้วยมาสก์

ทำงานบน OpenAI Image edits API: อัปโหลดภาพอ้างอิงหนึ่งภาพหรือมากกว่า พร้อมมาสก์โปร่งใสแบบเลือกใช้ได้สำหรับการแก้เฉพาะจุด

ระดับคุณภาพ

ต่ำ · กลาง · สูง

สามระดับคุณภาพอย่างเป็นทางการของ OpenAI ตั้งแต่ร่างเร็วไปจนถึงผลลัพธ์ที่พร้อมส่งงาน

การกำหนดขนาด

ด้านยาวสุด 3840 px

ใช้อัตราส่วนสำเร็จรูปหรือโหมด auto โดยผลลัพธ์ขึ้นกับความละเอียดที่เลือก และยาวได้สูงสุด 3840 px

FAQ ของ GPT Image 2

GPT Image 2 คิดค่าใช้งานอย่างไร?
คิดเป็นเครดิต — แต่ละภาพที่สร้างจะใช้เครดิต บัญชีใหม่มีเครดิตฟรีสำหรับเริ่มต้น และดูแพ็กเกจล่าสุดได้ที่หน้าราคา
GPT Image 2 คืออะไร? ใช่โมเดลเดียวกับเครื่องสร้างภาพใหม่ใน ChatGPT หรือไม่?
GPT Image 2 หรือ gpt-image-2 คือโมเดลภาพ native รุ่นใหม่ของ OpenAI ที่เปิดตัวในเดือนเมษายน 2026 เป็นเอนจินเบื้องหลังประสบการณ์สร้างภาพรุ่นใหม่ใน ChatGPT และออกแบบมาเพื่อทำตามคำสั่งได้แม่นยำขึ้น แสดงข้อความในภาพ เลย์เอาต์หลายภาษา และงานภาพที่ซับซ้อน
Image 2 GPT, GPT Image2, ChatGPT Image2 หรือ OpenAI Image2 คือสิ่งเดียวกันไหม?
ใช่ Image 2 GPT, GPT Image2, ChatGPT Image2 และ OpenAI Image2 ล้วนหมายถึงตระกูลโมเดลภาพใหม่ของ OpenAI ตัวเดียวกัน หรือก็คือความสามารถสร้างภาพล่าสุดใน ChatGPT ชื่อทางการคือ GPT Image 2 และ gpt-image-2 ส่วนชื่ออื่น ๆ เป็นชื่อเรียกทางเลือกที่พบบ่อยบนอินเทอร์เน็ต
ฉันใช้ GPT Image 2 ออนไลน์ได้ที่ไหน?
คุณใช้ GPT Image 2 ออนไลน์ได้ในพื้นที่สร้างภาพของ Pilio เริ่มจากพรอมป์ เพิ่มภาพอ้างอิงได้ตามต้องการ เลือกอัตราส่วนภาพ ความละเอียด คุณภาพ และจำนวนผลลัพธ์ แล้วสร้างโปสเตอร์ ม็อกอัป UI ภาพสินค้า ช่องการ์ตูน หรือเลย์เอาต์ข้อความหลายภาษาได้โดยไม่ต้องสลับเครื่องมือ
ทำไมผู้คนค้นหา Image 2 GPT และ ChatGPT Image2?
ชื่อโมเดลใหม่มักแพร่กระจายก่อนที่การสะกดอย่างเป็นทางการจะลงตัว Image 2 GPT, GPT Image2, ChatGPT Image2, OpenAI Image2 และ GPT image generator ชี้ไปที่โมเดลภาพล่าสุดตัวเดียวของ OpenAI ที่ขับเคลื่อนการสร้างภาพใน ChatGPT — ชื่อทางการคือ GPT Image 2 (gpt-image-2)
GPT Image 2 ต่างจาก GPT Image 1 อย่างไร?
เมื่อเทียบกับ GPT Image 1 แล้ว GPT Image 2 แข็งแรงกว่ามากในด้านการทำตามพรอมป์หลายเงื่อนไข การสร้างข้อความบนภาพมากกว่า 48 ภาษา และเลย์เอาต์ยาวอย่างโปสเตอร์หรือแพ็กเกจจิ้ง
รองรับความละเอียด อัตราส่วน และรูปแบบไฟล์อะไรบ้าง? มี 4K หรือพื้นหลังโปร่งใสไหม?
รองรับสูงสุด 4K (ด้านยาวสุด 3840px) มีอัตราส่วนสำเร็จรูปหลายแบบ และส่งออกเป็น WebP โดยค่าเริ่มต้น พื้นหลังโปร่งใสไม่ได้ใช้ได้กับทุกคำขอ
ควรเลือก GPT Image 2, DALL-E 3, Midjourney หรือ Nano Banana 2 อย่างไร?
ถ้าต้องการการจัดตัวอักษรที่แม่น โปสเตอร์หลายภาษา แพ็กเกจจิ้ง และหน้าการ์ตูน ให้เลือก GPT Image 2 ถ้าต้องการสำรวจงานศิลป์แบบหลวม ๆ ให้เลือก Midjourney และถ้าต้องการคอมโพสจากภาพอ้างอิงหลายใบ ให้เลือก Nano Banana 2
คุณภาพข้อความบนภาพเมื่อเทียบกับ Midjourney, Ideogram และ FLUX เป็นอย่างไร?
GPT Image 2 ทำงานได้เสถียรกว่ากับหัวเรื่องยาว ย่อหน้าแน่น โลโก้ และเลย์เอาต์ที่ผสมหลายระบบตัวอักษร จึงเหมาะกับงานที่ต้องพึ่งการจัดตัวอักษรคุณภาพสูงจริง ๆ
มันทำงานด้านกราฟิกดีไซน์ UI สตอรีบอร์ดการ์ตูน และภาพคนสมจริงได้ไหม?
ได้ โมเดลนี้เหมาะกับโฆษณาสิ่งพิมพ์ แพ็กเกจจิ้ง ม็อกอัป UI สตอรีบอร์ดการ์ตูน พอร์ตเทรตสมจริง และภาพเรนเดอร์สินค้า
ทำตามพรอมป์ดีแค่ไหน? รองรับการจัดตัวอักษรหลายภาษาปนกันหรือไม่?
ดีมาก ความสามารถในการทำตามคำอธิบายละเอียด จำนวนวัตถุ ทิศทางสไตล์ และข้อความหลายภาษาในภาพเดียวกัน คือหนึ่งในจุดแข็งหลักของโมเดลนี้
ภาพอ้างอิงทำงานอย่างไร? ใช้หลายภาพพร้อมกันได้ไหม?
การสร้างแต่ละครั้งรองรับภาพอ้างอิงได้หลายใบ อัปโหลดภาพที่ชัดและโฟกัสดี ระบุว่าแต่ละภาพควรเก็บอะไรไว้หรือส่งผลต่อส่วนไหน แล้วจึงเขียนในพรอมป์ว่าต้องการเปลี่ยนอะไร
มันเร็วแค่ไหน และคิดค่าบริการอย่างไร?
prompt ส่วนใหญ่เสร็จใน 10–60 วินาที งานซับซ้อนอาจใช้ได้ถึง 2 นาที สมัครแล้วมีเครดิตฟรี และคิดเครดิตต่อภาพที่สร้าง พร้อมแพ็กเกจยืดหยุ่น
ใช้เชิงพาณิชย์ได้ไหม? มีลายน้ำที่มองเห็นได้หรือเปล่า?
ผลลัพธ์ไม่มีลายน้ำที่มองเห็นได้ การใช้เชิงพาณิชย์ขึ้นอยู่กับสิทธิ์ของคุณในพรอมป์ วัสดุอ้างอิง บุคคล แบรนด์ รวมถึงนโยบายหรือกฎหมายที่เกี่ยวข้อง OpenAI อาจฝังสัญญาณแหล่งที่มาที่มองไม่เห็น โดยไม่กระทบผลลัพธ์ที่มองเห็น