Das Qwen-Team von Alibaba hat Qwen-Image-2.1 als Open Source veröffentlicht – ein visuelles Modell mit 7 Milliarden Parametern, das Text-zu-Bild-Generierung und Bildbearbeitung in einer einzigen Architektur vereint. Die Veröffentlichung kombiniert beide Fähigkeiten nativ und vereinfacht damit die Workflows für Kreative und Entwickler, die mit KI-generierten Bildern arbeiten. Das Modell unterstützt die transparente Bildgenerierung und -bearbeitung, akzeptiert bis zu 10 Referenzbilder für Mehrbild-Kompositionen und ermöglicht lokale Bearbeitung durch Auswahl- und Inpainting-Werkzeuge. Darüber hinaus bietet es eine erhöhte Detailtreue bei der Porträt- und Produktbearbeitung sowie eine verbesserte Darstellung von Textlayouts.