GPT Image 2.5 vs GPT Image 2: ผมรันพรอมป์ตเดียวกันผ่านทั้งสองโมเดล นี่คือจุดที่ต่างกันจริง ๆ

GPT Image 2.5 vs GPT Image 2: ผมรันพรอมป์ตเดียวกันผ่านทั้งสองโมเดล นี่คือจุดที่ต่างกันจริง ๆ

ข้อมูลเชิงลึกตีพิมพ์บน

OpenAI ปล่อย ChatGPT Images 2.5 เมื่อ 8 กันยายน และสรุปไว้ว่า "sharper details, more precise editing, and faster generation" ฝั่ง API หมายถึงสองโมเดลใหม่คือ GPT-Image-2.5 Flare และ GPT-Image-2.5 Sunburst ZOOOP เปิดใช้ทั้งคู่ในวันถัดมา เป็นสองเวอร์ชันของโมเดลเดียวในเครื่องมือสร้างภาพ AI

โพสต์เปิดตัวอ่านดีเสมอ ถ้าคุณสร้างภาพทุกวัน มีคำถามเดียวที่คุ้มค่าจะตอบ: ผมพอใจ GPT Image 2 อยู่แล้ว ย้ายไป 2.5 จะได้อะไรเพิ่มจริง ๆ? ผมเลยรันชุดพรอมป์ตเดียวกันผ่านทั้งสองรุ่น โดยไม่เปลี่ยนอะไรนอกจากโมเดล นี่คือสิ่งที่มองเห็น และสิ่งที่มองไม่เห็น

GPT Image 2.5 คืออะไร แล้ว Flare กับ Sunburst คืออะไร

เริ่มที่ชื่อก่อน เพราะ OpenAI ปล่อยออกมาสามชื่อพร้อมกัน

ChatGPT Images 2.5 คือชื่อผลิตภัณฑ์ใน ChatGPT ไม่มีโมเดล API ที่ชื่อ "2.5" มีอยู่สองตัวคือ Flare และ Sunburst ตามที่ OpenAI บอก Flare คือค่าเริ่มต้นสำหรับงานส่วนใหญ่ ให้ภาพคุณภาพสูงกว่า GPT-Image-2 ด้วยเวลาหน่วงครึ่งหนึ่ง ส่วน Sunburst สร้างมาสำหรับเวิร์กโฟลว์ระดับพรีเมียมที่ต้องการควบคุมการแก้ไขให้แน่นกว่า และใช้เวลาสร้างนานกว่า ทั้งคู่ใช้พรอมป์ต พารามิเตอร์ และอัตราส่วนภาพเดียวกัน

บน ZOOOP เราไม่ได้แยกเป็นสองโมเดล เพราะจะทำให้ดูเหมือนต้องเลือกระหว่างของสองอย่างที่ต่างกัน ทั้งคู่เป็นสองเวอร์ชันใต้ GPT Image 2.5 ห่างกันแค่สวิตช์เดียว นั่นคือเหตุผลที่การเทียบทั้งหมดในบทความนี้รันบน Flare เป็นค่าเริ่มต้น ส่วน Sunburst มีหัวข้อของตัวเองด้านล่าง

เมื่อเทียบกับ GPT Image 2 มีสามอย่างที่เปลี่ยนในระดับพารามิเตอร์: บันไดคุณภาพจาก Low / Medium / High กลายเป็นห้าระดับ โดยมี XHigh กับ Max อยู่บนสุด มีความละเอียด 4K ใหม่ และคำขอเดียวรับภาพอ้างอิงได้สูงสุด 16 ภาพจากเดิม 10 ที่เหลือเหมือนเดิม — อัตราส่วนภาพ 11 แบบ เขียนพรอมป์ตแบบเดิม

วิธีทดสอบ: พรอมป์ตเดิม เปลี่ยนแค่โมเดล

พรอมป์ตสี่ตัว ครอบคลุมสี่สิ่งที่ผมใส่ใจที่สุด รายละเอียดผ้าและโลหะ: ภาพระยะใกล้ของปกเสื้อเบลเซอร์สีกรมท่าลายก้างปลากับเข็มกลัดปกทองเหลือง ตัวอักษรเล็กในเฟรม: ป้ายไม้เขียนมือของร้านเบเกอรี่ เงาสะท้อนและวัสดุ: กาน้ำชาดำด้านบนเคาน์เตอร์หินขัดมัน การจัดตัวอักษร: โปสเตอร์คอนเสิร์ตวินเทจติดบนกำแพงอิฐ

พรอมป์ตแต่ละตัวรันหนึ่งครั้งบนแต่ละโมเดล — 16:9 ความละเอียดเดียวกัน คุณภาพ Low Low คือระดับที่ผมใช้บ่อยสุด และเป็นระดับที่เผยพื้นของโมเดล ระดับสูงสุดโมเดลไหนก็ใส่รายละเอียดกองได้ สำหรับพรอมป์ตผ้า ผมเพิ่มคู่ High และ Max หนึ่งภาพ ซึ่งมีแค่ใน 2.5 เพื่อดูว่าบันไดไปได้ไกลแค่ไหนจริง ๆ

ที่ไม่ได้ทดสอบที่นี่: การแก้ไขและการประกอบภาพจากหลายภาพอ้างอิง นั่นคือส่วนที่ OpenAI พูดถึง 2.5 มากที่สุด และสมควรได้บทความของตัวเอง

ความต่างข้อหนึ่ง: รายละเอียดที่คมชัด

สรุปสั้น ๆ: ภาพ Low ทั้งสองใช้ได้ ช่องว่างจะปรากฏเมื่อซูม GPT Image 2 มีลายก้างปลา แต่นุ่ม เหมือนมองผ่านผ้าก๊อซ GPT Image 2.5 ยกทุกเส้นให้ตั้ง และรอยเย็บตามขอบปกแน่นกว่า อีกช่องว่างไม่ใช่พื้นผิวแต่คือความเชื่อฟัง ผมขอเข็มกลัดทองเหลือง 2.0 วาดจี้ทรงตะเกียง 2.5 วาดกระดุมทองเหลืองกลมมีตราสัญลักษณ์ ไม่มีอันไหนตรงตามตำรา แต่ 2.5 ใกล้พรอมป์ตกว่า

พรอมป์ตเดียวกัน ซ้าย GPT Image 2 ขวา GPT Image 2.5 ทั้งคู่ Low

คู่กาน้ำชาอธิบายคำว่า "รายละเอียดที่คมชัด" ได้ชัดที่สุด ทั้งคู่ได้วัสดุของกาถูก ความต่างอยู่ที่เคาน์เตอร์ เงาสะท้อนของ 2.0 เป็นรอยเปื้อนมืดเบลอ ๆ 2.5 สะท้อนหูจับ ตัวกา และฝาทีละชิ้นบนหิน โดยมีลายหินอ่อนโผล่จากด้านล่าง นี่คือจุดอ่อนที่ผมพบบ่อยสุดกับเครื่องมือสร้างภาพ AI ทุกตัว — ตัวแบบดี แต่วงที่ตัวแบบสัมผัสกับสภาพแวดล้อมเละ 2.5 แน่นกว่าในวงนั้นอย่างเห็นได้ชัด

กาน้ำชาดำกับเงาสะท้อน ซ้าย GPT Image 2 ขวา GPT Image 2.5

ส่วนตัวอักษรในเฟรม: "MORNING LOAF · est. 1987" บนป้ายเบเกอรี่และสามบรรทัดบนโปสเตอร์ออกมาถูกต้องทุกตัวอักษรบนทั้งสองโมเดล ตัวอักษรที่อ่านได้เป็นลายเซ็นของสาย GPT Image มาตลอด 2.5 ไม่ถอยหลัง และก็ไม่ทิ้งห่าง ความต่างอยู่รอบ ๆ ตัวอักษร ป้ายของ 2.5 เป็นไม้ผุพังจริงแขวนบนตะขอเหล็ก โปสเตอร์มีรอยพับและหัวหมุด ป้ายของ 2.0 ดูเหมือนทาสีใหม่ และโปสเตอร์เพิ่มรถวินเทจที่พรอมป์ตไม่เคยขอ

ป้ายเบเกอรี่ ซ้าย GPT Image 2 ขวา GPT Image 2.5

โปสเตอร์คอนเสิร์ตวินเทจ ซ้าย GPT Image 2 ขวา GPT Image 2.5

ความต่างข้อสอง: คุณภาพสามระดับกลายเป็นห้า

กับสามระดับของ GPT Image 2 กฎของผมคือ Low พอ Medium รับองค์ประกอบแน่น ๆ High แทบไม่ใช้ 2.5 เพิ่ม XHigh กับ Max เหนือ High ปฏิกิริยาแรกคือ "ก็แค่ High ที่แพงขึ้น"

ที่พบกลับต่างออกไป: ขึ้นระดับไม่ได้ทำให้ภาพเดิมคมขึ้น แต่สร้างภาพใหม่ ในภาพ Low High และ Max เข็มกลัดเปลี่ยนจากตรากลมเป็นรูปใบไม้ เสื้อชั้นในเปลี่ยนจากเชิ้ตขาวเป็นสเวตเตอร์ครีมแล้วกลับมาเชิ้ต องค์ประกอบขยับ สิ่งเดียวที่ไต่ขึ้นอย่างมั่นคงคือผ้า ลายก้างปลาของ Max แน่นพอจะนับเส้นด้ายได้ High ตามมา ส่วน Low แยกจาก High แทบไม่ออกในขนาดเว็บ ดังนั้นถ้าแผนคือ "ล็อกองค์ประกอบที่ Low แล้วเรนเดอร์เฟรมเดิมที่ Max เพื่อพิมพ์" ทางนั้นไม่มี ให้ไต่บันไดตอนที่ยังรับได้ว่าองค์ประกอบจะเปลี่ยน

GPT Image 2.5 พรอมป์ตเดียวกันที่ Low High และ Max

คำแนะนำของผมเหมือนตอนใช้ 2.0 แค่บันไดยาวขึ้น: สำรวจที่ Low ล็อกองค์ประกอบ ยกขึ้นเฉพาะเฟรมที่จะส่งจริง ระดับไหนขึ้นกับว่าจะถูกดูใหญ่แค่ไหน โปสเตอร์พิมพ์ ฮีโร่หน้าแลนดิ้ง เพลต 4K — นั่นคือที่ของ XHigh กับ Max การอัปโพสต์โซเชียลแค่แพงขึ้น

ความต่างข้อสาม: 4K จอกว้างและภาพอ้างอิง 16 ภาพ

4K คือของใหม่ที่จับต้องได้ GPT Image 2.5 ออก 3840×2160 และ 2160×3840 ตรง ๆ ไม่ต้อง 2K แล้วขยาย — และเนทีฟกับขยายเป็นคนละเรื่องในรายละเอียดความถี่สูงอย่างใบไม้และเส้นผม

สิ่งที่ต้องรู้ก่อน: 4K มีเฉพาะสี่อัตราส่วนกว้างและตั้ง — 21:9, 16:9, 9:16 และ 9:21 อีกเจ็ดอัตราส่วนสูงสุดที่ 3K นี่คือเพดานพิกเซลของโมเดล ไม่ใช่ข้อจำกัดของ ZOOOP เราปิดตัวเลือกที่เลือกไม่ได้ให้เป็นสีเทา จะได้ไม่ต้องจ่าย รอครึ่งนาที แล้วได้ข้อผิดพลาด

เพดานภาพอ้างอิงจาก 10 เป็น 16 เป็นความสะดวกจริงสำหรับงานประกอบภาพอีคอมเมิร์ซและงานเลย์เอาต์: ภาพสินค้า พร็อพ การ์ดสี และเลย์เอาต์คร่าว ๆ ใส่ในคำขอเดียว โดยพรอมป์ตบรรยายการจัดวาง ผมไม่ได้ทำภาพเทียบสำหรับข้อนี้ แต่ "รักษาตัวแบบในภาพอ้างอิงได้ดีขึ้น" เป็นหนึ่งในเส้นเรื่องหลักของประกาศ OpenAI และตรงกับที่เราเห็นในการทดสอบกระจัดกระจายในเครื่องมือแก้ไขภาพ AI

ความต่างข้อสี่: Flare กับ Sunburst เรนเดอร์ต่างกันไหม

นี่คือข้อที่ผมอยากรู้ที่สุด เพราะบน ZOOOP ทั้งสองเวอร์ชันราคาเท่ากัน ถ้า Sunburst ช้ากว่าและไม่ดีกว่า จะมีไว้ทำไม

ผมรันพรอมป์ตปกเสื้อจากข้อหนึ่งผ่าน Sunburst ด้วยพารามิเตอร์เดียวกัน วางเทียบกัน ความแน่นของผ้า โลหะของเข็มกลัด และการไล่ระดับความชัดลึกเสมอกัน ทุกความต่างเป็นเรื่องสุ่ม — Flare ให้กระดุมทองเหลืองกลม Sunburst ให้เข็มกลัดใบโอ๊กแล้วเพิ่มผ้าเช็ดหน้ากระเป๋าเสื้อ พูดอีกอย่างคือ สำหรับการสร้างจากศูนย์ Sunburst ไม่ดีกว่า Flare

พรอมป์ตเดียวกัน ทั้งคู่ Low: ซ้าย Flare ขวา Sunburst

ช้ากว่าจริง แต่ผมให้ตัวเลขไม่ได้ ผมวัดคู่ชุดเดิมสองรอบ ทั้งสองรอบค่ามัธยฐานของ Sunburst ตามหลัง Flare แต่ระยะห่างต่างกันมากระหว่างรอบ และบางช่องกลับด้านไปเลย สิ่งที่ยืนได้คือทิศทาง ไม่ใช่ตัวคูณ ตรงกับตำแหน่งที่ OpenAI วางไว้: จุดแข็งของ Sunburst คือการแก้ไข — แบบ "เปลี่ยนแค่จุดนี้ ที่เหลือคงไว้" — ไม่ใช่ text-to-image

กฎจึงง่าย: ค่าเริ่มต้นคือ Flare สลับไป Sunburst เฉพาะเมื่อแก้ไขภาพที่มีอยู่แบบแม่นยำและการเปลี่ยนต้องลงตรงจุดที่คุณชี้ สำหรับ text-to-image และแบบร่างชุดใหญ่ Sunburst แค่ทำให้คุณรอนานขึ้น

อะไรควรย้ายไป 2.5 และอะไรปล่อยไว้ได้

รวมสี่ความต่างเป็นรายการเดียว

ย้ายไป GPT Image 2.5: ทุกอย่างที่จะถูกดูขนาดใหญ่ — คีย์วิชวลพิมพ์ ฮีโร่หน้าแลนดิ้ง พื้นหลังจอใหญ่ ทุกอย่างที่มีตัวอักษรเล็กหรือการจัดตัวอักษรแน่น ทุกอย่างที่ต้องการ 4K จอกว้างเนทีฟ ทุกอย่างที่ประกอบภาพอ้างอิงโหลกว่าภาพ ในกรณีเหล่านี้ช่องว่างมองเห็นได้

ไม่ต้องรีบ: ภาพโซเชียลประจำวัน ภาพที่ดูบนมือถืออย่างเดียว แบบร่างสำรวจสไตล์ล้วน ๆ ที่ Low ความต่างระหว่างสองรุ่นไม่คุ้มที่จะรันชุดเดิมใหม่ ถ้ามีชุดที่ทำด้วย GPT Image 2 และต้องการเพิ่มอีกไม่กี่ภาพให้เข้ากัน อยู่กับ 2.0 ปลอดภัยกว่า

งานใหม่เริ่มที่ 2.5 ในเครื่องมือสร้างภาพ AI ของ ZOOOP มันอยู่หน้า GPT Image 2 ในรายการ Flare เป็นเวอร์ชันเริ่มต้น และคุณภาพห้าระดับกับ 4K อยู่ในแผงเดียวกัน เครดิตใช้ร่วมกันทั้งสองโมเดล สลับไปมาไม่ต้องมีงบก้อนที่สอง

แบ่งปัน