
ล่าสุด OpenAI เปิดตัว ChatGPT Images 2.5 โมเดลสร้างภาพรุ่นใหม่ที่ยกระดับทั้งความคมชัด รายละเอียด พื้นผิว และแสงให้ดูเป็นธรรมชาติมากขึ้น พร้อมปรับปรุงความสามารถในการทำตามคำสั่งแก้ไขภาพ รวมถึงลดเวลาในการสร้างภาพได้สูงสุด 50% เมื่อเทียบกับ Images 2.0
OpenAI ระบุว่า ปัจจุบันมีการสร้างภาพผ่าน ChatGPT Images และโมเดล GPT-Image บน API มากกว่า 3 พันล้านภาพต่อสัปดาห์ สะท้อนให้เห็นว่าการสร้างภาพกำลังกลายเป็นหนึ่งในรูปแบบการใช้งานสำคัญของ Generative AI
หนึ่งในจุดที่ได้รับการปรับปรุงอย่างชัดเจนคือความสามารถในการแก้ไขภาพ โดย Images 2.5 ทำตามคำสั่งแก้ไขได้แม่นยำขึ้น และรักษารายละเอียดของตัวแบบหรือ Reference Image ได้ดีขึ้น โดยเฉพาะเมื่อมีการแก้ไขหลายรอบต่อเนื่อง
แนวทางดังกล่าวมีความสำคัญต่อการใช้งานจริง เพราะโจทย์ของคนทำคอนเทนต์และงานครีเอทีฟไม่ได้จบเมื่อสร้างภาพแรกเสร็จ แต่ยังต้องมีการแก้สินค้า เปลี่ยนองค์ประกอบ ปรับฉาก หรือทำภาพหลายเวอร์ชันภายใต้ทิศทางเดียวกัน
อย่างไรก็ตาม OpenAI ระบุใน Help Center ว่า การเลือกพื้นที่เพื่อแก้ไขภาพยังอาจไม่แม่นยำทุกครั้ง และการแก้ไขอาจขยายออกนอกพื้นที่ที่เลือกได้ จึงควรมอง Images 2.5 ว่าเป็นการ ยกระดับความแม่นยำ มากกว่าการรับประกันว่าองค์ประกอบอื่นจะไม่เปลี่ยนแปลงเลย
อีกฟีเจอร์ใหม่คือ Sketch ที่ช่วยให้ผู้ใช้วาดไอเดียคร่าว ๆ แล้วใช้ภาพร่างนั้นเป็น Reference เพื่อสร้างภาพต่อใน ChatGPT
ใน ChatGPT บนมือถือ ผู้ใช้สามารถพิมพ์ @ ในช่องข้อความ แล้วเลือก Sketch ก่อนวาดภาพร่างและใส่คำอธิบายเพิ่มเติม เช่น รูปแบบ สี หรือสไตล์ที่ต้องการ จากนั้นระบบจะนำทั้งภาพร่างและคำสั่งไปสร้างเป็นภาพใหม่
แนวทางนี้ช่วยลดข้อจำกัดของ Prompt แบบข้อความเพียงอย่างเดียว เพราะบางไอเดีย โดยเฉพาะเรื่องตำแหน่ง องค์ประกอบ และรูปทรง อาจสื่อสารผ่านภาพร่างได้ง่ายกว่าการอธิบายด้วยคำ
OpenAI ยังเพิ่ม Templates เพื่อช่วยให้ผู้ใช้เริ่มสร้างภาพจากรูปแบบที่เตรียมไว้ แทนการเริ่มจากหน้าว่าง พร้อมเปิดให้ปรับข้อความ องค์ประกอบ และสไตล์ต่อได้
นอกจากนี้ ผู้ใช้ยังสามารถแชร์ Prompt ที่ใช้สร้างภาพ เพื่อให้คนอื่นนำแนวคิดเดียวกันไปสร้างเวอร์ชันของตัวเองด้วยภาพและรายละเอียดที่แตกต่างกัน
สำหรับนักพัฒนา OpenAI เปิดตัวโมเดลบน API เพิ่มอีก 2 รุ่น ได้แก่ GPT-Image-2.5 Flare และ GPT-Image-2.5 Sunburst
GPT-Image-2.5 Flare ถูกวางให้เป็นตัวเลือกหลักสำหรับแอปพลิเคชันส่วนใหญ่ เน้นความเร็วและคุณภาพในการสร้างภาพ โดย OpenAI ระบุว่ามี latency ต่ำกว่า GPT-Image-2 ราว 50% เหมาะกับงานคอนเทนต์ โซเชียลมีเดีย Product Experience, Visual Search, Rapid Prototyping และงานที่ต้องสร้างภาพจำนวนมาก
ส่วน GPT-Image-2.5 Sunburst เน้นความแม่นยำในการสร้างและแก้ไขภาพมากกว่า โดยเหมาะกับงานที่ต้องควบคุมรายละเอียดสูง เช่น Campaign Creative หรือ Product Imagery แม้จะใช้เวลาในการสร้างนานกว่า Flare
สิ่งที่น่าสนใจของ ChatGPT Images 2.5 จึงไม่ได้อยู่แค่การสร้างภาพที่สวยขึ้น แต่คือความพยายามขยับ AI Image Generation เข้าใกล้ Creative Workflow มากขึ้น
เมื่อการวาด Sketch การสร้างภาพ การแก้ไขเป็นจุด การทำซ้ำหลายรอบ การเริ่มงานจาก Template และการแชร์ Prompt ถูกนำมาเชื่อมต่อในระบบเดียวกัน โจทย์จึงเริ่มเปลี่ยนจาก “AI สร้างภาพอะไรได้บ้าง” ไปสู่ “AI ช่วยลดขั้นตอนการทำงานของครีเอทีฟได้มากแค่ไหน”
OpenAI ระบุว่า ChatGPT Images 2.5 กำลังทยอยเปิดให้ผู้ใช้ ChatGPT, ChatGPT Work และ Codex ทุกระดับ ผ่าน desktop, mobile และ web ขณะที่ GPT-Image-2.5 Flare และ Sunburst เปิดให้ใช้งานผ่าน API แล้ว





