OpenAI, ChatGPT Images 2.5'i Yayınladı: Daha Keskin Detay ve Hassas Düzenleme
OpenAI, GPT-4o'nun yerel görsel motorunu 2.5 sürümüne yükselterek metin işleme, isteme sadakati ve çoklu tur düzenleme yeteneklerinde ciddi iyileştirmeler sundu.

OpenAI, bugün resmi kanalları üzerinden ChatGPT'in görsel üretim motorunu "ChatGPT Images 2.5" sürümüne yükselttiğini duyurdu. Güncelleme, modele entegre edilen yerel görsel yeteneğin (GPT-4o native image) ikinci büyük ince ayarını (fine-tune) işaret ediyor. Şirket, yeni sürümün "daha keskin detaylar" ve "daha hassas düzenleme" odaklı olduğunu belirtti.
Metin İşleme ve İsteme Sadakati Ön Planda
Yayınlanan teknik notlara göre 2.5 sürümündeki en belirgin gelişim, görseller içine yerleştirilen metinlerin yazım doğruluğu ve tipografik tutarlılığı. Önceki sürümlerde uzun metinlerde harf bozulmaları veya kelime sıralama hataları sık görülürken, yeni model tek bir istemle (prompt) poster, infografik veya kullanıcı arayüzü taslağı gibi yoğun metinli görselleri hata oranı önemli ölçüde düşürülmüş bir şekilde üretebiliyor. Ayrıca karmaşık, çok öğeli istemlerde (örneğin: "Sol üstte kırmızı bir küre, ortada onun yansıması olan bir küp, sağ altta da bu ikisinin gölgesi") nesne yerleşimi, ışık tutarlılığı ve perspektif ilişkileri daha yüksek bir sadakatle çözümleniyor.
Çoklu Tur (Multi-turn) Düzenleme Motoru Yenilendi
"Daha hassas düzenleme" vadesinin teknik karşılığı, sohbet bağlamı içinde yapılan ardışık düzenleme komutlarının (inpainting/outpainting) performansında. Kullanıcılar artık "Bu görselin arka planını geceye çevir, sonra sol üst köşeye ay ekle, son olarak ayın ışığını yüzeyin yansımasına ekle" gibi zincirleme talimatları verirken, model önceki adımlardaki kompozisyonu, ışığı ve nesne kimliğini koruyarak işlem yapabiliyor. OpenAI, bu yeteneğin arka planda görsel temsillerin (latent space) sohbet geçmişi ile daha sıkı bir hizalamadan (alignment) kaynaklandığını açıkladı.
Kullanım Sunusu ve Güvenlik Katmanları
Güncelleme, ChatGPT Plus, Pro, Team ve Enterprise aboneleri için bugünden itibaren kademeli olarak etkinleştiriliyor. Ücretsiz katman kullanıcılarına ise önümüzdeki haftalar içinde erişim sağlanacak. Güvenlik tarafında; tüm üretilen görseller C2PA standartlarında dijital imza (metadata) ile işaretlenmeye devam edecek. Ayrıca şiddet, cinsel içerik ve kimlik avı riski taşıyan gerçek kişi portreleri üzerine üretilen içerikler için mevcut güvenlik filtreleri (refusal mechanisms) 2.5 veri setiyle yeniden eğitildi.
Bu güncelleme, Midjourney v7, Flux 1.1 ve Ideogram 2.0 gibi rakiplerin de metin işleme ve düzenleme odaklı sürümler çıkardığı bir dönemde geliyor. Endüstri gözlemcilerine göre OpenAI'nin diferansiyel avantajı, görsel üretimi büyük dil modeli (LLM) mantığıyla birleştirerek "sohbet ederek tasarlama" akışını korumasıdır.
HaberGo Editor ve Muhabır ekibi
