Blockchain & Kripto

ChatGPT Images 2.5 ile Nano Banana 2: Hangisi Daha İyi?

ChatGPT Images 2.5 ile Nano Banana 2: Hangisi Daha İyi?
Dil okuluna gel, çalışarak ödediğin parayı geri kazan! Nasıl? →

Özetle

ChatGPT Images 2.5, 8 Eylül’de daha keskin detay, daha hassas düzenleme ve selefine göre en fazla %50 daha düşük gecikme ile yayınlandı.

Altı yeni test kategorisinde Nano Banana 2 üç galibiyet aldı, ChatGPT Images 2.5 diğerlerini kazandı.

Fark, çok belirgin sorunlardan ziyade birkaç doğrulanabilir hataya indi.

OpenAI, ChatGPT Images 2.5’ü 8 Eylül’de yayınladı ve vaat netti: daha keskin detaylar, daha zengin dokular, daha doğal aydınlatma ve değiştirmesini istemediğiniz şeylere saygı duyan bir düzenleme.

Şirket, görüntü oluşturma gecikmesinin Images 2.0’a kıyasla en fazla %50 düştüğünü söylüyor ve API’de artık GPT-Image-2.5 Flare ve GPT-Image-2.5 Sunburst olmak üzere iki yeni model bulunuyor; Flare hızlı varsayılan olarak kullanılıyor, Sunburst ise premium düzenleme hassasiyeti için tasarlandı.

Bu, Mayıs ayında yaptığımız karşılaştırmanın doğrudan devamı. O zaman GPT Image 2 ile Nano Banana 2 sekiz kategoride galibiyetleri paylaşmıştı. GPT Image 2 daha fazlasını kazanmıştı ancak istem çok fazla kısıtlama yığdığında belirgin bir aşırı keskinleştirme artefaktından mustarip olmuştu. O inceleme, OpenAI’nin bir sonraki modeli bu sorunu çözecek mi sorusuyla kapanmıştı.

Tekrar test ettik.

Aynı değerlendirici gözü, önceki turdan devralınan veya uyarlanan altı kategori, her iki modele de verilen aynı istemler. Testin Google tarafında kullanılan Nano Banana 2 —Google’ın Gemini 3.1 Flash Image için kullandığı ad—daha yavaş ve daha bilinçli Nano Banana Pro değil.

Bu aynı seviye bir eşleşme: OpenAI’nin yeni hızlı ve hassas modeli karşısında Google’ın hızlı ve hassas modeli.

GPT-Image 2.5’te gerçekten ne değişti

OpenAI’nin görüntü modelleri imza niteliğinde bir kusurla çıkma eğiliminde. Orijinal GPT Image 1’in arkasındaki model, internetin “piss filter” diye adlandırdığı kalıcı sıcak, sarı renk tonunu almıştı; OpenAI bu toni asla tam olarak açıklamadı ve asla tam olarak düzeltmedi.

GPT Image 2 bu sorunu farklı bir sorunla değiştirdi: istem çok fazla yığılmış kısıtlama içerdiğinde çıktı aşırı keskinleştirilerek pürüzlü, aşırı işlenmiş bir hale geliyor ve kalın artefaktlarla doluyordu.

Bu turda iki kusur da görülmedi. Images 2.5 ile ürettiğimiz her görüntü, tam karmaşıklıkta renk dengesini ve detayını korudu; sarı ton ya da iki selefinin işaret ettiği pürüzlü aşırı keskinleştirme yoktu. Bu gerçek, görünür bir düzeltme ve en çok steampunk ve portre testlerinde belirginleşiyor—her ikisi de ChatGPT’nin üç model kuşağı boyunca test ettiğimiz en fotoğrafik tutarlı çıktılar.

OpenAI ayrıca yan yana görüntü testinde görünmeyen ama iş akışı için önemli ürün özellikleri de ekledi: ChatGPT içinde kaba bir yerleşimi oluşturma referansı olarak kullanabileceğiniz Sketch, istem paylaşımı, belirli görüntü bölgelerinde satır içi yorumlar ve posterler ve ürünler için format şablonları. API tarafında, kalite katmanları artık Images 2.0’ın tavan yaptığı yerin üzerinde yeni yüksek ve maksimum seviyelere kadar düşükten yukarıya uzanıyor.

İşte OpenAI’nin yeni modeli Google’ın en iyi teklifiyle nasıl karşılaştırılıyor.

Harf yoğunluğu: Kellerman’s Hardware sahnesi

Bu en zorlayıcı olanı—neredeyse her yüzeyinde okunabilir metin bulunan dumanlı bir gece yarısı kesişimi: bir hayalet tabela, sprey boya grafiti, vinil dükkan tabelası, yırtık bir konser posteri, şablonlu kaldırım ve yapışkanlarla kaplı bir telefon kulübesi.

Nano Banana 2 neredeyse her şeyi temiz bir şekilde işledi. Tek kayma, bir telefon kulübesi çıkartmasının kendi metnini karışık bir şekilde tekrar etmesi—küçük, kolayca kaçırılabilecek bir kusur.

72d7cbce1ea5f30e5b954149b2d6db1b.webp

ChatGPT Images 2.5, Nano Banana’nın tamamen atladığı bir detayı ekledi: istemin tarif ettiği gibi üst üste tutturulmuş el ilanlarıyla yıpranmış, yırtık bir elektrik direği.

904ecb39da80af69ccb55e1f8588974f.webp

Ama modelin kendi sokak sanatı etiketi “STILLL HERE” diye okunuyor ve fazladan bir L var, ayrıca hayalet tabeladaki “KELLERMAN’S”taki apostrof eksik veya okunamaz. Tüm vaadi hassas metin oluşturma olan bir model için tek bir görüntüde iki ayrı okunabilirlik hatası gerçek bir kaçış.

Estetik açıdan OpenAI’nin modeli daha gerçekçi bir sahne üretti, ancak metin açısından aynı özeni göstermedi. Görüntü daha iyi görünse bile metin oluşturma Google’ınki kadar iyi değildi.

Kazanan: Nano Banana 2.

Mekansal farkındalık: Steampunk saat kulesi

Zorlayıcı bir havadan kompozisyon testi: beş düzlemli derinlik sahnesi, yüzleri farklı zamanları Roma rakamlarıyla okunabilir şekilde göstermesi gereken dev bir saat kulesi ve ön plandan arka plana saçılmış altı diğer metin öğesi.

ChatGPT Images 2.5, açık bir farkla daha atmosferik bir görüntü üretti—çatılardan yükselen görünen buhar, orta zemini kesen bir nehir, beş derinlik düzlemi boyunca daha zengin ton aralığı. Harfler bu üretimde okuması da daha kolay.

0a2578caa57f4b9046238b8aa35f84d2.webp

Nano Banana 2’nin atmosferi daha düz, ancak iki görünen saat yüzü de Roma rakamlarını—XII, III, VI, IX—benzer kol konumlarında okunabilir şekilde işliyor ki bu istemin istediği değildi.

79e5375c80232c94bfc3ab9f4062b9fc.webp

Kazanan: GPT Images 2.5, talimatları gerçekçilikten ödün vermeden daha iyi takip ettiği için.

İllüstrasyon: Anime ruh medyum

Bu istem, Studio Ufotable tarzında bir ana görsel istiyor: bir torii kapısında ruhani enerjiye dönüşen bir kız, dokuz kuyruklu bir kitsune tilkisi ve Makoto Shinkai tarzı alacakaranlık gökyüzü.

ChatGPT Images 2.5, bu seride şimdiye kadar çalıştırdığımız testlerin en iyi gökyüzünü sunuyor—gerçek bir güneş diski, su yansıması ve Shinkai karşılaştırmasını hak eden dağ silueti. Asimetrik gözler de iyi oturuyor. İstemden saptığı nokta “enerjiye dağılma” talimatı; model bunu akan, saydam bir dağılma yerine saçlarından geçen elektrik kıvılcımı etkisi olarak yorumluyor.

2f70110d54b4814f1898b9ce7424e831.webp

Nano Banana 2’nin uçuşan mavi-beyaz enerji izi, o belirli satıra daha yakın gerçekçi bir eşleşme. Hiçbir model ikna edici dokuz kuyruklu bir tilki oluşturamadı.

6313de19d0be1fea9c800710d6a391de.webp

Kazanan: ChatGPT Images 2.5, yorumlayıcı sapmaya rağmen genel görsel etkiyle.

Gerçekçilik: Çatıdaki mimar

Uzun bir bağımsız kısıtlama listesiyle sinematik bir portre: bej trençkot, yuvarlak gözlük, sol elde özellikle tutulan mimari planlar, altın saat aydınlatması, sığ alan derinliği, film tanesi.

ChatGPT Images 2.5 muhteşem bir ışık üretti—güneş diski doğrudan arkasında görünüyor ve cilt mikro dokusu mükemmel. Cilt çok pürüzsüz, ancak genel manzara çok gerçekçi, analog bir kamerayla çekilmiş gibi.

e2ce967c58ddd73371c72e699aa47fd3.webp

İlginç bir şekilde, fotoğraf kalitesini normalde kötü yapacak bazı komutlar eklemek gerçekçiliğini artırıyor. “realistic, highlights, crushed shadows, uneven flash, blown out skin tones, candid moment, shot on a phone camera” gibi anahtar kelimeler ekledikten sonra bir üretim şöyle:

ffe02d5c9506590e4caa42522522e58b.webp

Nano Banana 2 daha tam kompozisyonu koruyor, sağ el yerleşimiyle sol elle tutuş yerine ve çoğu oluşturma tamamen atlayan okunabilir bir plan etiketi ekliyor—“PROJECT: 124 DUANE ST”.

b95e6d3fe872aaddf44f8cd58ca4af31.webp

Kazanan: Nano Banana 2, tek bir çekim için; GPT tekrarlı yinelemeler için.

Ajanslı araştırma: Bitcoin zaman çizelgesi

Her iki platform da oluşturmadan önce bir konuyu araştırabiliyor, bu yüzden çocuk çizimi tarzında geniş ekran bir Bitcoin tarih zaman çizelgesi istedik ve gerçek doğruluk konusunda katı bir çubuk belirledik. Bu, karşılaştırma için en önemli kategoriydi ve en büyük fark burada ortaya çıktı.

ChatGPT Images 2.5, belirli tarihlerle temiz iki satırlı bir infografik oluşturdu—ve bunlardan biri yanlış. ABD’de Bitcoin ETF’lerinin 2023’te onaylandığını belirtiyor. SEC ilk spot Bitcoin ETF’lerini aslında 10 Ocak 2024’te onayladı—bir yıl daha geç, vadeli ETF’ler o yıl onaylansa da, bu bir yorumlama sorunu olabilir.

24c754e8147d26b1679976331c1d899a.webp

Nano Banana 2’nin çıktısı daha az yapılandırılmış ama benzer olayları aktarıyor, bu da modelin tekrarlanan istemlerde ne kadar az varyans gösterdiğini gösteriyor. Bununla birlikte, ETF onayını ve dördüncü yarıya inişi “2023–2024” aralığına yerleştirerek tek bir yanlış yıl iddia etmekten kaçınıyor, dolayısıyla belirttiği hiçbir şey teknik olarak yanlış değil.

01edebd4209ed5edc063e42a0aa9d6bf.webp

Kazanan: Nano Banana 2. “Ajanslı akıl yürütme”nin doğru çıktı üretip üretmediğini özellikle test eden bir kategoride kendinden emin bir yanlış tarih daha önemli.

Soyut kavramlar: Anlamsız kelimelerden oluşan bir istem

Bu, neredeyse tamamen anlamsız kelimelerden oluşan bir istem kullandı: “A woman eating shmfiyxl in Lyxin. Next to her, her Lymglsushing plays Lakishkark.” Yemek, mekan, arkadaş veya oyun için sözlük tanımı yok—her model bir tane icat etmek ve nasıl göstereceğine karar vermek zorunda.

ChatGPT Images 2.5 bunu sahneye doğrudan yazı olarak yazarak çözdü. “Lyxin” şık, fütüristik bir restoran üzerinde neon bir tabelada parlıyor. “Lakishkark” kadının uzaylı masasının oynadığı masa oyununun kutusunda basılı. Uydurma kelimeler soyut olmaktan çıkıyor ve okunabilir tabela haline geliyor.

02be8d4119f9469bc2476d4b7ac67a7a.webp

Nano Banana 2 tam tersi bir yaklaşım benimsedi. Sıcak, kültürel olarak özgün bir sahne oluşturdu—Guatemala pazar tezgahı, geleneksel huipil giyen bir kadın, hibrit telli-borulu bir çalgı çalan ork benzeri bir yaratık—ve “plays”ı oyun oynamak yerine müzik çalmak olarak okudu, farklı ama eşit derecede geçerli bir yorum. Çerçevede “Lyxin” veya “Lakishkark”a bağlanan hiçbir şey yok; uydurma kelimeler hiçbir yerde görünür metin olarak yüzeye çıkmıyor.

fe9c1809f5b26c1071e2748173d06521.webp

Kazanan: ChatGPT Images 2.5. Tanımsız kavramları okunabilir etiketlere dönüştürmek, ona çalışmak için başka bir şey vermeyen bir isteme daha gerçekçi bir cevap.

Nano Banana 2 bu turda altı kategoriden üçününü kazandı, yani pratikte berabere. Her şey beklentilerinize ve modelle etkileşim şeklinize bağlı olacak. ChatGPT Images 2.5 ayrıca selefini rahatsız eden aşırı keskinleştirme sorununu da düzeltti ve bu turdaki illüstrasyon çıktısı, iki tam test turu boyunca her iki modelin ürettiği en görsel olarak çarpıcı tek görüntü olabilir.

İkisini ayıran genel kalite değil, çok küçük özel şeyler: doğrulanabilir kaçışlar, harf yoğun bir sahnede yazım hatası, araştırma odaklı bir infografikte yanlış yıl vb.

Ama genel estetik ve kalite açısından birbirlerine oldukça yakınlar.

Uzun dönem Malta'da, üniversite destekli okullarda dilini geliştir. Kayıt bilgisi →

Kaynak: Decrypt