OpenAI, ChatGPT Images 2.0’ı duyurdu. Yeni sürüm, gelişmiş talimat takibi, metin içeren görseller ve akıl yürütme yeteneğiyle dikkat çekiyor.
OpenAI, kullanıcıların sohbet robotu üzerinden görsel ve tasarım oluşturmasına olanak tanıyan ChatGPT Images 2.0’ı kullanıma sundu. Bu yeni sürüm, görsel üretim modellerinde önemli bir ilerleme olarak tanımlanıyor.
Images 2.0, talimatları daha ayrıntılı takip etme, yoğun metin içeren görseller üretme ve nesneleri sahnede konumlandırma yetenekleriyle öne çıkıyor. OpenAI, bu geliştirmelerin görsel üretimde bir “kademe atlama” olduğunu belirtiyor.
OpenAI, ilk kez akıl yürütme yeteneğine sahip bir görsel üretim modeli geliştirdi. Bu model, web araması yapabiliyor ve kendi çıktılarını doğrulayabiliyor. Bu özellik, doğruluk ve tutarlılığın kritik olduğu durumlarda daha güvenilir sonuçlar vaat ediyor.
Ayrıca, Images 2.0’ın Latin alfabesi dışındaki dilleri anlama ve oluşturma becerisi geliştirildi. Japonca, Korece, Çince, Hintçe ve Bengalce’deki “belirgin kazanımlar” ile farklı görsel dilleri daha sadık biçimde yeniden üretme yeteneği artırıldı. Bu, oyun prototipleme ve storyboard oluşturma gibi alanlarda aracı daha işlevsel hale getiriyor.
Yeni model, 3:1 geniş veya 1:3 uzun görseller gibi farklı en boy oranlarında üretim yapabiliyor. 2K çözünürlüğe kadar tasarım üretebilen sistem, tek seferde sekiz adede kadar çıktı verebiliyor.
Images 2.0, ücretsiz ve Go aboneliği dahil tüm ChatGPT kullanıcılarına sunuluyor. Plus ve Pro aboneleri daha gelişmiş çıktılara erişebilecek. OpenAI, modeli API hizmeti ve Codex kodlama uygulaması aracılığıyla da erişilebilir kılıyor.
Bu duyuru, Anthropic’in kendi tasarım asistanıyla görsel tasarım pazarına girmesinden kısa bir süre sonra geldi.
Yorum Yap