Nhóm Qwen của Alibaba đã mở mã nguồn Qwen-Image-2.1, một mô hình thị giác 7 tỷ tham số tích hợp khả năng tạo ảnh từ văn bản và chỉnh sửa ảnh vào một kiến trúc duy nhất. Bản phát hành này kết hợp cả hai khả năng một cách nguyên bản, giúp tinh giản quy trình làm việc cho các nhà sáng tạo và nhà phát triển đang làm việc với hình ảnh do AI tạo ra. Mô hình hỗ trợ tạo và chỉnh sửa ảnh trong suốt, chấp nhận tối đa 10 ảnh tham chiếu để tổng hợp đa ảnh, đồng thời cho phép chỉnh sửa cục bộ thông qua các công cụ lựa chọn và inpainting. Mô hình cũng mang lại độ trung thực được nâng cao cho việc chỉnh sửa chân dung và sản phẩm, cùng khả năng kết xuất bố cục văn bản được cải thiện.