动察 Beating tarafından yapılan izlemeye göre, Qianwen üçüncü nesil görüntü oluşturma modeli Qwen-Image-3.0'ı yayınladı. Yeni model maksimum 4.5k Token girişini destekliyor ve özellikle karmaşık düzenler, küçük metinler ve bilgi tabanlı görüntülerin oluşturulmasına odaklanıyor.
Tek bir uzun komutla gazete, sınav kağıdı, kısa dizi storyboard'u ve dokuz kareli bilgi grafiği oluşturabiliyor. Model aynı görüntü içinde birden fazla konuyu işleyebiliyor ve aynı anda formüller, grafikler, kişiler ile Çince ve İngilizce metinler üretebiliyor. Resmi olarak gösterilen dokuz kareli bir görüntü, dokuz farklı bağımsız içerik türünü içeriyor ve açıklama komutu yaklaşık 3.7k Token uzunluğunda.
Metin işleme de daha da geliştirildi. Qianwen, modelin 10px kadar küçük metinleri net bir şekilde oluşturabildiğini ve LaTeX formülleri, üst/alt simgeler, el yazısı notlar ve gazete yoğun düzenlerini işleyebildiğini belirtiyor. Gözenekler, saç telleri, kağıt ve çizim dokuları gibi detaylar da daha gerçekçi hale geldi.
Qwen-Image-3.0, yerel olarak 12 dil, 100'den fazla sanat stili ve çeşitli UI arayüzlerini destekliyor. Resmi olarak ayrıca internete bağlı hava durumu grafiği oluşturma, geleneksel resimleri onarma ve profesyonel bilgi grafikleri hazırlama gibi kullanım örnekleri de gösterildi. Sadece güzel görüntüler üretmekten ziyade, bu nesil daha çok PPT, eğitim materyalleri, tasarım ve içerik üretimi gibi pratik senaryolara odaklanıyor.
