GPT Image 2.5 vs GPT Image 2: Aynı promptları ikisinden de geçirdim. Gerçekten farklılaştıkları yer burası

GPT Image 2.5 vs GPT Image 2: Aynı promptları ikisinden de geçirdim. Gerçekten farklılaştıkları yer burası

GörüşlerYayınlandı

OpenAI, ChatGPT Images 2.5'i 8 Eylül'de yayınladı ve şöyle özetledi: "sharper details, more precise editing, and faster generation". API tarafında bu, iki yeni model demek: GPT-Image-2.5 Flare ve GPT-Image-2.5 Sunburst. ZOOOP ikisini de ertesi gün, AI görüntü oluşturucu içinde tek modelin iki sürümü olarak yayına aldı.

Lansman yazıları hep iyi okunur. Her gün görsel üretiyorsanız cevaplanmaya değer tek soru var: GPT Image 2'den memnunum — 2.5'e geçince gerçekten ne kazanırım? Ben de aynı prompt setini iki nesilden geçirdim ve modelden başka hiçbir şeyi değiştirmedim. İşte görünen ve görünmeyen.

GPT Image 2.5 nedir, Flare ve Sunburst nedir

Önce isimler, çünkü OpenAI bir seferde üç tane çıkardı.

ChatGPT Images 2.5, ChatGPT içindeki ürün adı. API'de "2.5" adında bir model yok — iki tane var: Flare ve Sunburst. OpenAI'ye göre Flare çoğu uygulama için varsayılan; GPT-Image-2'den daha kaliteli görselleri yarı gecikmeyle veriyor. Sunburst ise düzenlemelerde daha sıkı kontrol isteyen premium iş akışları için tasarlanmış ve üretimi daha uzun sürüyor. İkisi aynı promptları, parametreleri ve en-boy oranlarını paylaşıyor.

ZOOOP'ta bunları iki ayrı model olarak listelemedik — bu, iki farklı şey arasında seçim yapıyormuşsunuz izlenimi verir. GPT Image 2.5 altında tek bir anahtar uzağında iki sürüm. Bu yazıdaki tüm karşılaştırmaların varsayılan olarak Flare'de koşmasının nedeni de bu; Sunburst'ün aşağıda kendi bölümü var.

GPT Image 2 ile karşılaştırınca parametre düzeyinde üç şey değişti: kalite merdiveni Low / Medium / High'dan, en üstte XHigh ve Max olan beş kademeye çıktı; yeni bir 4K çözünürlük geldi; tek istek artık 10 yerine 16 referans görsel alıyor. Geri kalan her şey aynı — on bir en-boy oranı, promptlar aynı şekilde yazılıyor.

Yöntem: aynı promptlar, yalnızca model değişir

En çok önemsediğim dört şeyi kapsayan dört prompt. Kumaş ve metal detayı: pirinç yaka iğneli lacivert balıksırtı bir blazerın yakasına yakın plan. Karedeki küçük yazı: bir fırının elle boyanmış ahşap tabelası. Yansıma ve malzeme: cilalı taş tezgâh üzerinde mat siyah bir demlik. Tipografi: tuğla duvara iğnelenmiş eski bir konser afişi.

Her prompt her modelde bir kez koştu — 16:9, aynı çözünürlük, Low kalite. Low en çok kullandığım kademe ve bir modelin tabanını ortaya çıkaran kademe; en üst kademede her model detay yığar. Kumaş promptu için bir High çifti ve yalnızca 2.5'te olan bir Max render ekledim; merdivenin gerçekten nereye kadar çıktığını görmek için.

Burada test edilmeyen: düzenleme ve çok referanslı kompozit. OpenAI'nin 2.5 için en çok konuştuğu alanlar bunlar ve kendi yazılarını hak ediyorlar.

Fark bir: çözünürleşen detay

Kısa versiyon: iki Low render da kullanılabilir; fark yaklaştırınca çıkıyor. GPT Image 2'de balıksırtı var ama yumuşak, tül arkasından bakılmış gibi. GPT Image 2.5 her damarı dikiyor, yaka kenarındaki dikiş daha sıkı. Diğer fark dokuda değil, itaatte. Pirinç yaka iğnesi istedim; 2.0 fener biçimli bir süs çizdi, 2.5 armalı yuvarlak pirinç bir düğme. İkisi de kitabî değil ama 2.5 prompta daha yakın.

Aynı prompt, solda GPT Image 2, sağda GPT Image 2.5, ikisi de Low

Demlik çifti "çözünürleşen detay"ın ne demek olduğunu en net gösteren. İkisi de demliğin malzemesini tutturuyor; fark tezgâhta. 2.0'ın yansıması belirsiz koyu bir leke. 2.5 kulpu, gövdeyi ve kapağı taşın üzerine tek tek yansıtıyor, altından mermer damarları görünüyor. Bu, herhangi bir AI görüntü oluşturucuda en sık takıldığım zayıf nokta — özne iyi, öznenin çevreyle buluştuğu halka bulanıyor. 2.5 o halkada belirgin biçimde daha yoğun.

Siyah demlik ve yansıması, solda GPT Image 2, sağda GPT Image 2.5

Karedeki yazıya gelince: fırın tabelasındaki "MORNING LOAF · est. 1987" ve afişteki üç satır iki modelde de harfi harfine doğru çıktı. Okunabilir tipografi GPT Image serisinin her zaman imzasıydı; 2.5 bunu geriletmiyor, öne de geçmiyor. Farklar harflerin çevresinde. 2.5'in tabelası demir kancalara asılı gerçekten yıpranmış ahşap, afişinde kat izleri ve iğne başları var. 2.0'ın tabelası yeni boyanmış gibi duruyor, afişi de promptun hiç istemediği eski bir araba eklemiş.

Fırın tabelası, solda GPT Image 2, sağda GPT Image 2.5

Eski konser afişi, solda GPT Image 2, sağda GPT Image 2.5

Fark iki: üç kalite kademesi beş oluyor

GPT Image 2'nin üç kademesinde kuralım şuydu: Low yeter, Medium yoğun kompozisyonlar için, High nadiren. 2.5, High'ın üstüne XHigh ve Max ekliyor; ilk tepki "yani daha pahalı bir High".

Bulduğum farklıydı: bir kademe yükselmek aynı görseli keskinleştirmiyor — yeni bir görsel üretiyor. Low, High ve Max renderlarında iğne yuvarlak armadan yaprak biçimine döndü, alttaki katman beyaz gömlekten krem kazağa ve geri gömleğe geçti. Kompozisyon oynadı; istikrarla yükselen tek şey kumaştı. Max'in balıksırtı iplikleri sayılacak kadar yoğun, High ondan sonra, Low ise web boyutunda High'dan neredeyse ayrılmıyor. Planınız "kompozisyonu Low'da kilitle, sonra aynı kareyi baskı için Max'te yeniden render et" idiyse, o yol yok. Merdiveni kompozisyonun değişmesini hâlâ kabul edebildiğiniz aşamada çıkın.

GPT Image 2.5, aynı prompt Low, High ve Max'te

Tavsiyem 2.0'dakiyle aynı, sadece merdiven daha uzun: Low'da keşfet, kompozisyonu kilitle, yalnızca gerçekten teslim edeceğin kareyi yükselt. Hangi kademe, ne kadar büyük görüleceğine bağlı. Basılı poster, açılış sayfası hero'su, 4K plaka — XHigh ve Max'in yeri orası. Bir sosyal medya postunu yükseltmek sadece daha pahalıya gelir.

Fark üç: geniş ekran 4K ve 16 referans görsel

4K somut ekleme. GPT Image 2.5 3840×2160 ve 2160×3840'ı doğrudan veriyor, 2K sonra büyütme yok — ve yaprak, saç gibi yüksek frekanslı detaylarda yerli ile büyütülmüş başka şey.

Baştan bilinmesi gereken bir şey: 4K yalnızca dört geniş ve dikey oran için var — 21:9, 16:9, 9:16 ve 9:21. Diğer yedi oran 3K'da duruyor. Bu modelin piksel tavanı, ZOOOP sınırı değil; seçilemeyen kombinasyonları griye alıyoruz ki ödeyip yarım dakika bekleyip hata almayın.

Referans sınırının 10'dan 16 görsele çıkması e-ticaret kompozitleri ve yerleşim işleri için gerçek bir kolaylık: ürün çekimleri, aksesuarlar, renk kartı ve kaba bir yerleşim, hepsi tek istekte, düzeni prompt anlatıyor. Bunun karşılaştırmasını çekmedim ama "referans fotoğraflarınızdaki özneleri daha iyi koruma" OpenAI duyurusunun ana hatlarından biri ve AI görüntü düzenleyicide dağınık denemelerde gördüğümüzle uyuşuyor.

Fark dört: Flare ve Sunburst farklı mı render ediyor?

En çok netleştirmek istediğim buydu, çünkü ZOOOP'ta iki sürüm aynı fiyatta. Sunburst daha yavaş ve daha iyi değilse ne işe yarıyor?

Bir numaralı farktaki yaka promptunu aynı parametrelerle Sunburst'ten geçirdim. Yan yana kumaş yoğunluğu, iğnenin metali ve alan derinliği düşüşü berabere; her fark rastgele — Flare yuvarlak pirinç düğme verdi, Sunburst meşe yaprağı iğne verip bir de cep mendili ekledi. Yani sıfırdan üretimde Sunburst, Flare'den iyi değil.

Aynı prompt, ikisi de Low: solda Flare, sağda Sunburst

Daha yavaş olduğu kesin ama bir sayı veremem. Aynı eşleşmiş çift kümesini iki kez ölçtüm: her iki turda da Sunburst'ün medyanı Flare'in gerisinde kaldı, ancak aradaki fark turdan tura epey değişti ve bazı hücreler ters döndü. Ayakta kalan yön, çarpan değil. Bu OpenAI'nin konumlandırmasıyla örtüşüyor: Sunburst'ün gücü düzenlemede — "sadece şunu değiştir, gerisini bırak" türünden — text-to-image'da değil.

Kural basit: varsayılan Flare. Yalnızca mevcut bir görselde hassas düzenleme yaparken ve değişikliğin tam işaret ettiğiniz yere düşmesi gerekirken Sunburst'e geçin. Text-to-image ve toplu taslaklarda Sunburst sizi sadece bekletir.

2.5'e taşınacaklar ve olduğu gibi kalacaklar

Dört farkı tek listede toplayalım.

GPT Image 2.5'e taşı: büyük görülecek her şey — basılı ana görseller, açılış sayfası hero'ları, büyük ekran arka planları; küçük yazı veya yoğun tipografi içeren her şey; yerli geniş ekran 4K gereken her şey; bir düzine ve üstü referans görseli birleştiren her şey. Bu durumlarda fark görünür.

Acele yok: günlük sosyal medya görselleri, yalnızca telefonda görülen görseller, saf stil keşfi taslakları. Low'da nesiller arasındaki fark mevcut bir seti yeniden koşturmayı haklı çıkarmıyor. GPT Image 2 ile yapılmış bir setiniz varsa ve uyumlu birkaç tane daha lazımsa 2.0'da kalmak daha güvenli.

Yeni işe 2.5'ten başlayın. ZOOOP'un AI görüntü oluşturucusunda listede GPT Image 2'nin önünde, Flare varsayılan sürüm, beş kalite kademesi ve 4K aynı panelde. Krediler iki modelde ortak; gidip gelmek ikinci bir bütçe gerektirmiyor.

Paylaş