Команда Qwen компании Alibaba выпустила с открытым исходным кодом Qwen-Image-2.1 — визуальную модель с 7 миллиардами параметров, которая объединяет генерацию изображений по текстовому описанию и редактирование изображений в единую архитектуру. Новый релиз изначально сочетает обе возможности, упрощая рабочие процессы для авторов контента и разработчиков, работающих с визуальными материалами, созданными с помощью ИИ. Модель поддерживает генерацию и редактирование изображений с прозрачным фоном, принимает до 10 референсных изображений для композиции из нескольких картинок и обеспечивает локальное редактирование с помощью инструментов выделения и дорисовки (inpainting). Кроме того, она демонстрирует повышенную точность при редактировании портретов и изображений товаров, а также улучшенную отрисовку текстовых макетов.