Message IA de ME : aperçu sur Beating AI. Qianwen publie Qwen-Image-2.1 et met à disposition les poids du modèle. Il intègre la génération d’images à partir de texte et l’édition d’images au sein d’un même modèle. La partie génération visuelle ne nécessite que 7B paramètres, tout en prenant nativement en charge les images 2K et les images avec arrière-plan transparent. Les capacités d’édition sont au cœur de cette mise à niveau. Qwen-Image-2.1 peut au maximum accepter simultanément 10 images de référence pour réorganiser et recomposer plusieurs personnes ou produits dans une même image. Les modifications locales peuvent aussi être directement sélectionnées au pinceau, dessinées, ou réalisées via un masque : pas besoin de lancer un modèle d’édition séparé. Il peut également générer directement des images RGBA avec un canal Alpha : autrement dit, le modèle produit lui-même des éléments à fond transparent, et peut aussi extraire les sujets depuis des photos. Diffusers, ComfyUI, vLLM-Omni et SGLang sont tous intégrés dès le premier jour ; les workflows locaux n’ont donc pas besoin d’attendre une adaptation progressive par des tiers. Toutefois, ici, le terme « open source » nécessite un correctif : les poids sont bien rendus publics, mais la licence est la Qwen Research License, qui n’autorise que la recherche et l’évaluation non commerciales ; toute utilisation commerciale nécessite une autorisation supplémentaire auprès de Qianwen. (Source : ME)
