Yapay zekada büyük yarış artık sadece metin değil görsel alanda da hız kazanıyor. Google, yeni güncellemesi Gemini 2.5 Flash Image ile bu rekabette güçlü bir adım attı.
Artık kullanıcılar, fotoğraf düzenleme işlemlerini yalnızca doğal dil komutlarıyla çok daha hassas şekilde yapabilecek. Yani bir tişörtün rengini değiştirmek, bir arka planı düzenlemek ya da farklı görselleri birleştirmek mümkün olacak; üstelik yüzler bozulmadan ve kediniz bir mutant yaratığa dönüşmeden.
Rakip modellerin en çok eleştirilen yönü, küçük bir detay istendiğinde tüm görselin bozulmasıydı. Google, yeni sisteminde özellikle yüzler, hayvanlar ve karmaşık objeler için görsel tutarlılığı büyük ölçüde geliştirdiğini söylüyor.
Model, geçtiğimiz haftalarda “nano-banana” takma adıyla LMArena topluluk platformunda sessiz sedasız test edildi ve kısa sürede dikkat çekti. DeepMind ekibi, bu teknolojiyi “state of the art” yani alanının en iyisi olarak tanımlıyor.
Artık kullanıcılar daha gerçekçi senaryolar da oluşturabiliyor. Örneğin, farklı renk paletleriyle bir salon dekorunu görselleştirmek, bir bahçedeki ışığı projeye göre ayarlamak ya da tek bir detayı düzeltip genel uyumu bozmamak mümkün.

Sertleşen rekabet
Bu hamlenin stratejik bir yönü var. OpenAI, ChatGPT’ye entegre ettiği görsel araçlarla milyonları peşinden sürükledi. Yalnızca birkaç hafta içinde viral içeriklerle öne çıkan GPT-4o, özellikle “Studio Ghibli tarzı” görsellerle interneti kasıp kavurdu. ChatGPT bugün haftalık 700 milyon kullanıcıya ulaşırken, Gemini aylık 450 milyon kullanıcı seviyesinde kalıyor.
Meta da Midjourney ortaklığıyla kendi görsel araçlarını güçlendiriyor. Alman girişim Black Forest Labs ise FLUX modelleriyle benchmark’larda adından söz ettiriyor. Tüm bu gelişmeler karşısında Google’ın sessiz kalması artık mümkün değildi.
Daha sıkı güvenlik önlemleri alındı
Google için asıl soru ise “kullanıcılar gerçekten neler üretebilecek?” Şirket daha önce tarihsel temsil hataları nedeniyle bazı işlevleri kapatmak zorunda kalmıştı. Yeni sürümde daha sıkı güvenlik önlemleri devreye alınmış durumda.
Üretilen görsellere otomatik olarak filigran ve meta veriler ekleniyor. Ayrıca Google, özellikle izinsiz ve müstehcen içeriklerin oluşturulmasını tamamen engelliyor. Rakiplerinden Grok, ünlülerin deepfake görüntüleriyle tepki toplarken, Google bu alanda daha kontrollü ilerlemek istiyor.
Elbette bu önlemler, sahte görsellerin sosyal medyada yayılmasını tamamen durduramayacak. Ancak Google, en azından yaratıcı ve güçlü bir araç sunarken “kontrolden çıkmama” iddiasını öne çıkarıyor.



