OpenAI'nin yeni nesil görüntü üretim modeli olduğu düşünülen 'mona-lisa-1' kod adlı bir model, kör test platformu LM Arena'da görüldü. Modelin ürettiği görsellerde OpenAI'nin SynthID dijital filigranının tespit edilmesi, şirketin yeni modelini gizlice test ettiği yönündeki inancı güçlendiriyor.
Test sonuçlarına göre model, mevcut amiral gemisi GPT Image 2'ye kıyasla görsel gerçekçilikte belirgin bir sıçrama sağlıyor. Özellikle kullanıcıların uzun süredir şikayet ettiği 'plastik' cilt dokusunu iyileştirdiği, cilt dokusunu ve kamera grenini proaktif olarak üreterek yapay zeka görünümünü azalttığı belirtiliyor.
Model, LM Arena'da yayınlandıktan sonra geliştirici topluluğunun dikkatini çekti. Bir kullanıcının modele 'yaratıcınızın görselini üret' talebi üzerine model doğrudan OpenAI ve CEO Sam Altman'ı işaret etti. Daha teknik bir kanıt ise @AiBattle_ kullanıcısının üretilen bir görseli OpenAI'nin doğrulama aracından geçirmesiyle geldi; SynthID filigranı başarıyla tespit edildi.
OpenAI konuya resmi bir açıklama yapmadı. Ancak bu 'çıkış öncesi kör test' yöntemi sektörde biliniyor. Dört ay önce GPT Image 2 de Arena'da Maskingtape ve Gaffertape kod adlarıyla benzer bir anonim teste tabi tutulmuş, ardından 242 puanlık Arena Elo farkıyla görüntü üretiminde en güçlü ticari model olarak taçlandırılmıştı.
Testler ne gösteriyor?
Geliştirici Riccardo Wolf, GPT Image 2 ile mona-lisa-1'i aynı komutlarla karşılaştırdı. Sokak portrelerinde mona-lisa-1 daha doğal ayrıntılar sundu: cilt dokusu, yüzdeki çiller ve saçın dağınıklığı daha belirginken, arka plan bokeh geçişleri daha doğal görünüyordu.
'Plastik' görünümü hedef alan bir testte, modele gece geç saatte bir market önünde akıllı telefon flaşıyla fotoğraf çeken dört kişilik bir görsel üretmesi istendi; 'güzellik filtresi yok, plastik cilt yok, sinematik ışık yok' gibi katı kısıtlamalar eklendi. Sonuçta mona-lisa-1, yağlı cilt parlaması, kızarıklık ve lokal aşırı pozlama gibi kusurlarıyla gerçek bir amatör kareye oldukça yakın bir görüntü üretti.
Model ayrıca renk karışımı, ışık-gölge katmanları ve atmosfer yaratmada da önceki yapay zeka resimlerindeki 'algoritmik' hissi tamamen ortadan kaldırdı. Bilgi grafiği üretiminde de başarılı olan model, gerçekçi web arayüzü taslakları ve insan organlarının karmaşık anatomik diyagramlarını üretebiliyor; hatta Albert Einstein'ın el yazısını taklit edebiliyor.
Kusurlar ve teknik ipuçları
Her şeye rağmen model kusursuz değil. Bazı test kullanıcıları, belirli görsellerde hâlâ belirgin gren ve blok artefaktlar gözlemlediklerini bildirdi. Bazıları 'daha fazla ayrıntının' her zaman 'daha gerçekçi görüntü' anlamına gelmediğini, bilinçli eklenen grenin bazen yeni artefaktlar yaratabildiğini belirtti.
Modelin teknik altyapısına dair ipuçları da var. @ivanainai kullanıcısının sürekli testlerine göre mona-lisa-1'in bilgi tabanı 2025'te donmuş durumda ve internet arama yeteneği yok. 10 Eylül 2025'te vurularak öldürülen Charlie Kirk'ün hâlâ yaşayıp yaşamadığı sorulduğunda model yanlış bir yanıt verdi; bu da eğitim verisinin Mayıs 2025 civarında kesildiği tahminini güçlendiriyor. Mevcut GPT Image 2'nin bilgi kesintisi ise Aralık 2025.
Bu durum, mona-lisa-1'in devrim niteliğinde bir mimari değişiklik değil, aynı nesil teknoloji üzerine inşa edilmiş yeni bir kontrol noktası olabileceğini gösteriyor. Kod adındaki '-1' eki, ileride '-2' gibi daha fazla sürümün test edilebileceğine işaret ediyor. Bazı sektör gözlemcileri, şimdiye kadar ortaya çıkanın nihai amiral gemisi değil, yalnızca bir 'GPT Image 2.5 orta seviye sürümü' olabileceğini değerlendiriyor.
Neden önemli
GPT Image 2'nin zirveye yerleşmesinden sadece dört ay sonra OpenAI'nin kendi rekorunu kırmaya başlaması, görüntü üretimindeki rekabetin ne kadar hızlı ilerlediğini gösteriyor. Eğer mona-lisa-1 yalnızca bir ara kontrol noktasıysa, resmi sürüm yayınlandığında yapay zeka görüntü üretiminin çıtası önemli ölçüde yükselecek demektir. Sektör, OpenAI'nin bu 'Mona Lisa'nın perdesini ne zaman kaldıracağını yakından izliyor.