Qu’est-ce que Qwen Image 3 ? Le nouveau modèle d’image d’Alibaba expliqué
L'IA d'Alibaba Qwen Image 3 accepte des prompts plusieurs fois plus longs que la génération précédente, permet l'édition à partir de jusqu'à trois images de référence et affiche du texte lisible en petite taille. Voici ce que cela change concrètement.

Qwen Image 3 est désormais le modèle texte-vers-image par défaut sur OFGenerator, et qwen-image-3-edit est le mode d'édition par défaut. C'est la troisième génération de la ligne d'image d'Alibaba, la plus performante à ce jour — mais elle fonctionne aussi différemment des modèles auxquels la plupart des créateurs sont habitués.
Le problème, comme toujours, c'est l'accès. Alibaba a introduit Qwen Image 3 fin juillet 2026, via le même modèle d'API hébergée que le reste de la gamme Qwen Image — aucun poids téléchargeable, aucun nœud ComfyUI, aucun chemin en local. Au moment de la rédaction, la documentation officielle d'Alibaba Cloud décrit encore le modèle comme étant en preview limitée, avec un accès accordé sur candidature via le Model Gallery plutôt que par une simple inscription publique. La voie officielle passe par un compte Alibaba Cloud, une candidature et une console à parcourir avant de pouvoir générer quoi que ce soit.
OFGenerator fonctionne désormais avec Qwen Image 3. Vous ouvrez un navigateur, vous écrivez votre prompt ou vous importez une image de référence, et vous générez. C'est tout.

Ce que change vraiment Qwen Image 3
Il est disponible en deux éditions — Standard et Pro —, toutes deux servies par la même API hébergée. Les quatre changements qui comptent :
- Des prompts jusqu'à 4 500 tokens. C'est plusieurs fois la longueur d'entrée documentée par Alibaba pour la génération précédente (sa propre documentation situe la série qwen-image-2.0 à 1 300 tokens maximum). Vous pouvez décrire une image de façon exhaustive — sujet, éclairage, cadrage et objectif, tenue, arrière-plan, ambiance — en un seul prompt, au lieu de compresser tout ça en une soupe de mots-clés en espérant que le modèle comble les trous. Cette capacité à suivre des prompts longs est la propriété qui définit ce modèle.
- Édition par référence avec 1 à 3 images. Le mode d'édition prend jusqu'à trois images de référence et change le décor, le style, les vêtements ou le texte tout en préservant les détails que vous voulez conserver. C'est un vrai changement de capacité, pas une simple amélioration — ça transforme l'édition en opération contrôlable plutôt qu'en nouvelle tentative au hasard.
- Un texte qui reste lisible. Qwen Image 3 gère le texte jusqu'à environ dix pixels, nativement dans 12 langues et plus de 20 polices. Une enseigne dans une scène, une légende incrustée dans une image, une affiche, un habillage de marque — les endroits où un pseudo-texte illisible trahissait autrefois une génération IA.
- Une sortie fermée, pour l'instant. Contrairement à Qwen Image 1.0 — un modèle MMDiT de 20 milliards de paramètres qu'Alibaba a publié ouvertement sous licence Apache 2.0, avec un rapport technique complet —, la version 3 est sortie sans poids ouverts, sans fiche modèle, sans score de benchmark publié. C'est un accès hébergé uniquement, et de surcroît restreint.

Ce que ça donne en pratique
La différence pratique se joue dans la façon de prompter. Qwen Image 3 récompense la structure : le sujet, puis l'éclairage, puis le cadrage, puis la tenue, puis l'arrière-plan, puis l'ambiance. Écrit ainsi, chaque section est réellement prise en compte au lieu d'être diluée dans une impression générale — et vos prompts deviennent réutilisables, puisque vous changez une section au lieu de tout réécrire.
Nommer le cadrage fait plus de travail que n'importe quelle pile d'adjectifs qualitatifs. « 85 mm, f/1.8, cadrage à la taille, légèrement au-dessus du niveau des yeux » donne un résultat plus précis qu'un empilement de mots comme ultra réaliste, 8k, chef-d'œuvre. Cet empilement était une habitude héritée de l'ère SDXL, et sur un modèle avec une telle marge de suivi d'instructions, il gaspille des tokens qui pourraient décrire le plan lui-même.
Pour l'édition, le modèle répond bien à une séparation explicite : nommez ce qui doit rester identique, et nommez ce qui doit changer. « Garder le visage, les cheveux et les proportions du corps inchangés ; changer le décor pour une cuisine baignée de soleil » fonctionne mieux que de décrire l'image cible depuis zéro.
Où il se situe parmi les autres modèles
Qwen Image 3 n'est pas le bon modèle pour toutes les tâches, et il vaut la peine de savoir où il se situe.
Ses points forts sont le suivi de prompt, le contrôle en édition et le texte. Ça le rend solide pour les scènes composées, les visuels produit et lifestyle, les mises en page façon affiche, et tout ce qui doit correspondre à un brief précis. Standard est assez rapide pour l'exploration en volume ; Pro échange de la vitesse contre du détail sur les visuels qui comptent vraiment.
Là où d'autres modèles gardent l'avantage : si vous cherchez un photoréalisme maximal sur le grain de peau en gros plan, les checkpoints basés sur SDXL restent compétitifs, et les modèles dédiés au photoréalisme méritent d'être testés en parallèle. Si la vitesse prime avant tout, les modèles de classe turbo génèrent en une fraction du temps. L'avantage de tout regrouper au même endroit, c'est que changer de modèle ne coûte rien — même interface, mêmes images de référence.
Pourquoi OFGenerator l'exécute à votre place
Avec la plupart des modèles d'image performants, le compromis, c'est l'installation : plusieurs gigaoctets à télécharger, ComfyUI à installer, 24 Go de VRAM à trouver, une soirée de configuration. Pénible, mais possible.
Qwen Image 3 supprime carrément cette option. Il n'existe aucun chemin hors ligne vers ce modèle. Soit vous avez un accès hébergé, soit vous n'avez pas le modèle — et la voie officielle, aujourd'hui, est une console cloud à candidature, pensée pour des équipes en entreprise, pas pour le projet d'un après-midi d'un créateur solo.
OFGenerator prend une position différente : vous ne devriez pas avoir à faire tout ça. Nous faisons tourner les deux éditions ainsi que les deux modes d'édition, aux côtés du reste du catalogue. Pas de compte Alibaba, pas de candidature à déposer, rien à configurer.
Qwen Image 3 est disponible sur OFGenerator.
Essayer OFGenerator — crédits gratuitsPour aller plus loin
Si vous cherchez à savoir quel modèle utiliser pour quelle tâche, notre guide complet de la génération d'images IA couvre le texte-vers-image, l'image-vers-image et comment choisir entre les deux. Pour la structure des prompts en particulier, notre guide pour écrire des prompts IA efficaces propose des modèles de prompt à adapter. Et si vous construisez un personnage destiné à porter toute une bibliothèque de contenu, notre guide pour construire un modèle IA cohérent explique comment garder des traits cohérents d'une génération à l'autre.


