A equipe Qwen da Alibaba disponibilizou em código aberto o Qwen-Image-2.1, um modelo visual de 7 bilhões de parâmetros que integra a geração de imagens a partir de texto e a edição de imagens em uma única arquitetura. O lançamento combina nativamente ambas as capacidades, simplificando os fluxos de trabalho de criadores e desenvolvedores que trabalham com visuais gerados por IA. O modelo oferece suporte à geração e à edição de imagens transparentes, aceita até 10 imagens de referência para composição de múltiplas imagens e permite a edição local por meio de ferramentas de seleção e inpainting. Ele também proporciona maior fidelidade na edição de retratos e de produtos, além de uma renderização aprimorada do layout de texto.