OpenAI เปิดตัว ChatGPT Images 2.5 ชูแก้ภาพแม่นขึ้น เร็วขึ้นสูงสุด 50%

กอง บก. ZanZabNews10 กันยายน 202684 Views

ผู้ใช้กำลังพิมพ์คำสั่งแก้ไขทรงผมจากภาพถ่ายของตนใน ChatGPT
ChatGPT Images 2.5 เน้นการแก้ไของค์ประกอบในภาพตามคำสั่งโดยพยายามคงรายละเอียดส่วนอื่นไว้

OpenAI เปิดตัว ChatGPT Images 2.5 โมเดลสร้างภาพรุ่นใหม่ที่เน้นให้ผู้ใช้สร้างและแก้ไขภาพได้ตรงกับคำสั่งมากขึ้น บริษัทระบุว่ารุ่นนี้ลดเวลาในการสร้างภาพได้สูงสุด 50% เมื่อเทียบกับ Images 2.0 พร้อมเพิ่มฟีเจอร์ Sketch สำหรับเปลี่ยนภาพร่างหรือไอเดียคร่าว ๆ ให้เป็นภาพที่สมบูรณ์ขึ้น

ประเด็นสำคัญจึงไม่ได้อยู่แค่การสร้างภาพใหม่ แต่เป็นการทำงานต่อจากภาพเดิมได้ละเอียดขึ้น ทั้งการแก้เฉพาะองค์ประกอบ การใช้ภาพต้นแบบ และการค่อย ๆ ปรับงานหลายรอบในบทสนทนาเดียว

Precision Editing เน้นแก้เฉพาะจุดและรักษาส่วนอื่นของภาพ

OpenAI ระบุว่า ChatGPT Images 2.5 ยกระดับ Precision Editing เพื่อให้ปรับเปลี่ยนเฉพาะองค์ประกอบที่ต้องการ โดยพยายามคงองค์ประกอบหลัก ฉากหลัง การจัดวาง และรูปแบบแบรนด์ของภาพเดิมไว้ เหมาะกับโจทย์อย่างเปลี่ยนสินค้า เปลี่ยนพื้นหลัง หรือแก้ข้อความ โดยไม่ต้องให้ส่วนอื่นเปลี่ยนตาม

ภาพตัวอย่างผู้ใช้ถ่ายเซลฟีพร้อมทรงผมหลายแบบที่สร้างจากภาพต้นแบบเดียวกัน
การปรับทรงผมจากภาพต้นแบบเป็นตัวอย่างการแก้ไของค์ประกอบเฉพาะส่วนตามคำสั่ง

อีกส่วนคือการแก้ภาพต่อเนื่องหลายรอบผ่านการสนทนา ซึ่งบริษัทระบุว่าระบบรักษาความสอดคล้องของการแก้ไขก่อนหน้าได้ดีขึ้น จึงช่วยให้ผู้ใช้ค่อย ๆ ปรับภาพทีละขั้นได้โดยรายละเอียดเดิมไม่ลดลงง่าย

ตู้ปลาที่มีพื้นที่ทำงานขนาดเล็กและข้อความคำสั่งแก้ไขภาพสองขั้นตอน
การสั่งปรับพื้นที่ทำงานทีละขั้นแสดงแนวคิดการแก้ภาพต่อเนื่องผ่านบทสนทนา

ทำงานกับภาพต้นแบบและคำสั่งที่ซับซ้อนได้มากขึ้น

สำหรับภาพต้นแบบ Images 2.5 รองรับการนำภาพบุคคลหรือวัตถุไปสร้างในสถานการณ์ สไตล์ และองค์ประกอบใหม่ ๆ โดย OpenAI ระบุว่าปรับปรุงการรักษาลักษณะเฉพาะขององค์ประกอบหลัก รวมถึงแสงและพื้นผิวให้ดูเป็นธรรมชาติมากขึ้น

โมเดลยังรองรับคำสั่งด้านภาพที่ซับซ้อน เลย์เอาต์หลายรูปแบบ และพื้นหลังโปร่งใส จึงถูกวางไว้สำหรับงานที่ต้องทำภาพหลายชิ้นให้มีทิศทางเดียวกัน เช่น งานครีเอทีฟ แคมเปญ สื่อประชาสัมพันธ์ และภาพประกอบพรีเซนเทชัน

ชุดตัวอย่างงานภาพแบรนด์ Iron Comet Racing ที่ใช้โลโก้ สีเขียว และภาพผลิตภัณฑ์ในทิศทางเดียวกัน
งานภาพหลายชิ้นที่มีทิศทางแบรนด์เดียวกันเป็นกรณีใช้งานที่ OpenAI ระบุไว้สำหรับ Images 2.5

Sketch, Templates และการแชร์ Prompt ช่วยเริ่มจากไอเดียได้เร็วขึ้น

ฟีเจอร์ Sketch เปิดให้ผู้ใช้วาดภาพหรือโครงร่างไอเดียใน ChatGPT แล้วใช้เป็น Visual Guide สำหรับสร้างภาพต่อ ตัวอย่างที่ OpenAI ยกมาคือแปลนห้อง รูปทรงเสื้อผ้า หรือภาพร่างแบบง่าย ก่อนเติมคำอธิบายเรื่องสไตล์และรายละเอียด โดยเรียกใช้ได้ด้วยการพิมพ์ @Sketch ใน ChatGPT

หน้าจอ Sketch ที่มีภาพร่างวัตถุและตัวอย่างวัตถุที่สร้างจากภาพร่างในหลายวัสดุ
Sketch ใช้ภาพร่างเป็น Visual Guide ก่อนเติมสไตล์และรายละเอียดที่ต้องการใน ChatGPT

ขณะเดียวกัน OpenAI เพิ่ม Templates สำหรับงานอย่าง Poster และ Merch เพื่อให้เริ่มจากโครงสร้างที่กำหนดไว้ได้ รวมถึงเพิ่มการแชร์ภาพพร้อม Prompt เพื่อให้ผู้รับนำแนวคิดเดิมไปต่อยอดเป็นเวอร์ชันของตัวเอง

API เพิ่ม GPT-Image-2.5 Flare และ Sunburst

ฝั่งนักพัฒนา OpenAI เปิดตัว GPT-Image-2.5 Flare และ GPT-Image-2.5 Sunburst ผ่าน API โดย Flare เป็นตัวเลือกหลักสำหรับแอปพลิเคชันส่วนใหญ่ที่เน้นคุณภาพ การแก้ไขภาพ และความเร็ว ขณะที่ Sunburst ออกแบบมาสำหรับงานที่ต้องควบคุมรายละเอียดมากขึ้น โดยยอมใช้เวลาในการสร้างนานขึ้นเพื่อแลกกับความแม่นยำในการแก้ไข

OpenAI ระบุว่าปัจจุบันมีการสร้างภาพผ่าน ChatGPT Images และโมเดล GPT-Image บน API มากกว่า 3,000 ล้านภาพต่อสัปดาห์ และ ChatGPT Images 2.5 เปิดให้ใช้แล้วสำหรับผู้ใช้ ChatGPT, ChatGPT Work และ Codex ทุกระดับบนเดสก์ท็อป มือถือ และเว็บไซต์ ส่วน Flare กับ Sunburst เปิดใช้ผ่าน API โดยมีรายละเอียดราคาแยกตามบริการ

สำหรับผู้ใช้ทั่วไป จุดที่เห็นได้ชัดคือการมีเครื่องมือช่วยเริ่มจากภาพร่างและแก้ภาพต่อเนื่อง ส่วนทีมที่ต้องทำงานกับภาพจำนวนมากสามารถดูความสามารถด้านการรักษาองค์ประกอบและการแก้เฉพาะจุดเป็นทางเลือกในการจัดเวิร์กโฟลว์ได้

ข้อมูลเพิ่มเติม: OpenAI Official Blog

Loading Next Post...
Search Trending
Loading

Signing-in 3 seconds...

Signing-up 3 seconds...