Pour ceux qui font tourner l’IA sur leur propre ordinateur, les modèles d’image avaient une manie agaçante : chaque nouveau modèle était meilleur, et chaque nouveau modèle était plus gros. Un meilleur texte et des détails plus nets voulaient généralement dire qu’il fallait une carte graphique plus chère.
Qwen-Image-2.1, publié par Alibaba le 20 septembre 2026, rompt avec cette tendance. Il est plus petit que les modèles d’image Qwen qui l’ont précédé, et il en fait davantage.
Petit, et étonnamment capable
La partie du modèle qui dessine réellement l’image compte 7 milliards de paramètres. C’est nettement moins que le générateur de 20 milliards de paramètres des précédents modèles Qwen-Image. Selon Alibaba, ce résultat vient d’une architecture épurée – 32 couches « à flux unique » qui traitent le texte et l’image ensemble – et d’astuces qui évitent de refaire deux fois le même travail.
Pour vous, cela signifie un modèle plus léger et moins coûteux à faire tourner. Et il en contient davantage :
- Des images transparentes. Demandez un autocollant, un sprite de jeu vidéo ou un détourage de produit, et il peut en générer un avec un fond réellement transparent. La plupart des modèles peignent un fond et vous laissent l’effacer, en général avec un halo flou autour des cheveux ou du verre. Qwen-Image-2.1 peut aussi retoucher des calques transparents et extraire un sujet d’une photo existante.
- Jusqu’à dix références. Donnez-lui la photo d’une personne, une veste trouvée sur une boutique en ligne et l’image d’une pièce, et il peut placer cette personne, vêtue de cette veste, dans cette pièce. Parmi les exemples d’Alibaba figure une photo de groupe assemblée à partir de six portraits distincts.
- Montrer plutôt que décrire. Pour modifier une partie d’une image, vous pouvez l’entourer, gribouiller dessus ou fournir un masque, au lieu d’essayer d’expliquer avec des mots où se trouve « le truc à gauche ».
- Sortie en 2K. Il génère nativement en 2048×2048, ainsi qu’en formats panoramique, portrait et autres.
Dès le premier jour, il fonctionnait dans ComfyUI et Hugging Face Diffusers, les deux façons les plus répandues de faire tourner des modèles d’image en local.
Le hic : la licence a changé
C’est là que la bonne nouvelle se complique.
Les précédents modèles d’image Qwen étaient publiés sous Apache 2.0, l’une des licences les plus généreuses du monde du logiciel. On pouvait les télécharger, les modifier, les intégrer à un produit et vendre ce qu’ils produisaient sans rien demander à personne.
Qwen-Image-2.1 est, lui, publié sous la Qwen Research License.
Cette licence vous autorise à expérimenter, à faire de la recherche et à créer de l’art pour vous-même. Mais dès que vous bâtissez une application payante dessus, que vous vendez des images générées à des clients ou que vous l’utilisez dans un produit commercial, il vous faut un accord séparé avec Alibaba.
Ce n’est pas qu’un détail juridique. Les outils d’image open source prospèrent parce que les gens partagent librement leurs extensions : styles, personnages et versions affinées. Une licence réservée à la recherche signifie que moins d’entreprises investiront dans cet écosystème, qui devrait donc croître plus lentement qu’il ne l’aurait fait sous Apache.
Pour qui ?
- Les amateurs, étudiants, chercheurs et artistes qui créent des œuvres personnelles : c’est l’un des modèles d’image les plus capables que l’on puisse faire tourner chez soi. Il est compact, crée de vraies images transparentes et sait jongler avec dix références à la fois. Essayez-le.
- Ceux qui montent une activité : lisez d’abord la licence. Pour une liberté commerciale sans avoir à demander d’autorisation, FLUX.2 Klein et les autres modèles sous licence permissive restent le terrain le plus sûr.
Qwen-Image-2.1 montre à quel point les petits modèles d’image locaux sont devenus bons. Il montre aussi qu’« ouvert » et « librement utilisable à des fins commerciales » ne sont pas toujours synonymes.