Alibaba’dan metin işleme yetenekleriyle öne çıkan yapay zeka görüntü oluşturma modeli: Qwen-Image
| Ağustos 5, 2025 | Posted by SiberBulucu.Com under Genel |
|
Geçtiğimiz günlerde kodlamaya odaklanan açık kaynaklı yapay zeka modeli Qwen3-Coder‘ı tanıtan Alibaba, şimdi de yapay zeka görüntü üretme alanında açık kaynak modelini Qwen-Image ile karşımızda. Bildiğiniz üzere yapay zeka görsel üretimi araçları metinleri doğru bir şekilde işleme konusunda zorluklar yaşıyordu. Stable Diffusion ve GPT-4o destekli Sora başta olmak üzere şirketler bu zorluğun aşılabildiğini bizlere göstermişti. Qwen-Image da metinleri doğru bir şekilde işleme konusunda üstün performans gösteriyor.
Modelin mimarisi ve eğitim süreci
Model, çok satırlı Çince karakterler de dahil olmak üzere karmaşık metinleri doğrudan yüksek kaliteli görüntüler içinde üretme konusunda son teknolojiye sahip. Temelinde Multimodal Diffusion Transformer (MMDiT) mimarisi detaylı ⇒
Alıntının kaynağı: Webrazzi
