Qwen-Image-3.0 : le champion open-weight passé derrière un mur
Écrit par Clement
Qwen-Image-3.0 est le modèle d'image de troisième génération d'Alibaba, lancé le 21 juillet 2026 via les applications Qwen Chat et Qwen Studio et une API sur invitation. Son changement phare est une fenêtre de prompt bien plus grande, environ 4 500 tokens contre environ 1 000 pour Qwen-Image-2.0, que l'éditeur utilise pour rendre en une seule passe des travaux denses de texte et de mise en page : affiches multilingues, infographies à plusieurs panneaux, maquettes d'interface imbriquées, storyboards de films, formules.
Le plus important est ce qui n'est pas sorti. Qwen-Image 1.0 et 2.0 sont arrivés avec des poids ouverts sous Apache-2.0 et un rapport technique le jour même. 3.0 n'a ni poids téléchargeables, ni fiche de modèle, ni licence, ni nombre de paramètres, ni benchmarks publiés. Qwen était le champion de l'image open-weight, et cette version est passée derrière un mur hébergé. Si vous avez choisi Qwen précisément pour l'héberger vous-même, ce revirement est la première chose à savoir, et c'est donc par là que cette page commence.
Fiche rapide
- Créé par
- Alibaba (Tongyi / Qwen), son modèle d'image de troisième génération
- Lancé le
- 21 juillet 2026
- Où il tourne
- Applications Qwen Chat et Qwen Studio, plus une API Alibaba sur invitation. Hébergé uniquement
- Poids ouverts
- Aucun. C'est une rupture avec Qwen-Image 1.0 et 2.0, publiés avec des poids Apache-2.0 le jour même
- Fenêtre de prompt
- ~4 500 tokens (annoncé par l'éditeur), contre environ 1 000 pour la 2.0
- Rendu de texte
- 12 langues et plus de 20 polices intégrées, lisible jusqu'à ~10 pixels (démos de l'éditeur)
- Benchmarks
- Aucun publié. Pas de fiche de modèle, pas de nombre de paramètres, pas de rapport technique
- Tarifs
- Non publiés au lancement
La seule nouveauté concrète : une fenêtre de prompt bien plus longue
Le vrai changement de la 3.0 est la taille de la fenêtre d'instructions. Alibaba indique qu'elle accepte environ 4 500 tokens de prompt, soit à peu près 4,5 fois la limite d'environ 1 000 tokens de Qwen-Image-2.0. Une fenêtre plus grande compte pour une tâche précise : décrire une douzaine d'éléments et plusieurs blocs de texte littéral en une seule génération, pour que le modèle compose toute une mise en page d'un coup au lieu de vous obliger à assembler des morceaux.
Les cas d'usage annoncés en découlent : une page de style journal avec titres, légendes et corps de texte ; une infographie à plusieurs panneaux avec des sections étiquetées ; une mise en page académique avec formules ; une affiche multilingue. L'éditeur y associe un rendu de texte natif dans 12 langues et plus de 20 polices intégrées, et montre un texte qui reste lisible jusqu'à une dizaine de pixels. Si votre travail est lourd en typographie et en mise en page, c'est la raison de regarder ce modèle plutôt qu'un modèle purement esthétique.
Nous construisons et exploitons une plateforme de compagnons IA, et nous lisons les affirmations de capacités avec la question « est-ce mesuré, ou est-ce une vidéo de démo ? ». Tout ce qui précède est annoncé par l'éditeur. Il n'y a ni tableau de benchmarks, ni rapport technique, ni évaluation tierce pour l'accompagner : considérez donc l'affirmation sur les prompts longs et la typographie dense comme la seule fonction nouvelle concrète, pas comme un résultat de qualité vérifié.
Du ouvert au fermé : le revirement et pourquoi il compte
Qwen a bâti sa réputation en partie sur son ouverture. Qwen-Image 1.0 est sorti en août 2025 avec des poids Apache-2.0 et un rapport technique le jour même, et la 2.0 a suivi dans le même esprit. Cette combinaison, licence permissive et poids téléchargeables, est précisément ce qui permettait de le faire tourner en local sans compte, sans facturation à l'image et sans télémétrie, et c'est pour cela que beaucoup de gens qui hébergent eux-mêmes ont choisi Qwen au départ.
La 3.0 rompt ce schéma. Elle est hébergée uniquement, derrière un accès API sur invitation et les applications Qwen, sans poids ni licence publiés. Pour qui avait adopté Qwen pour garder la génération sur son propre matériel, la 3.0 n'est pas une mise à niveau directe : c'est un autre produit, avec un autre modèle de confiance. Ce n'est pas un jugement de valeur sur les images, c'est un constat sur l'accès, du genre que les listes des concurrents omettent volontiers parce qu'il complique l'histoire simple du « plus récent, donc meilleur ».
Être fermé n'est pas forcément un défaut ; beaucoup de bons modèles sont uniquement hébergés. Le point à retenir est plus étroit : si la raison précise pour laquelle vous étiez sur Qwen était la génération locale, sans compte et sans télémétrie, cette raison ne se prolonge pas à la 3.0, et il faut prévoir autre chose plutôt que de supposer une continuité.
Ce que vous pouvez en faire aujourd'hui
L'accès se fait via Qwen Chat et Qwen Studio plus une API sur invitation : c'est un produit qu'on demande et qu'on attend, pas un modèle qu'on télécharge et qu'on fait tourner. Dans les applications, vous écrivez en langage naturel, et la longue fenêtre permet de remettre un brief complet : texte exact du titre, intitulés de sections, langue de chaque bloc, emplacement approximatif, et de le laisser composer l'ensemble en une génération.
Le meilleur usage est le travail commercial de texte et de mise en page, où le texte illisible et les mises en page cassées sont l'échec habituel des modèles d'image : affiches, visuels publicitaires avec un vrai texte, storyboards, maquettes d'interface, infographies de connaissances. Le support de 12 langues et la gamme de polices visent précisément ce marché. Comme il n'y a ni limites ni tarifs publiés, le plafond pratique et le coût par image se découvrent dans l'application plutôt qu'en lisant une page : prévoyez-le dans votre budget si cela entre dans un pipeline de production.
Sa place face aux alternatives
Pour du texte dense et lisible dans une image, la génération de mise en page par prompt long est l'endroit où la 3.0 pose sa revendication, et c'est une vraie niche où la plupart des modèles d'image généralistes sont faibles. Si c'est exactement votre travail, cela vaut la peine de demander l'accès et de comparer sur vos propres briefs riches en texte plutôt que sur des scènes génériques.
Dès que l'ouverture, le contrôle local ou un coût prévisible comptent plus que l'astuce de mise en page, la comparaison penche dans l'autre sens. Un modèle open-weight que vous hébergez vous-même a un coût fixe et connu et ne demande aucun compte, ce qui, pour un gros volume ou un travail sensible à la confidentialité, est souvent tout l'argument ; notre guide Z-Image couvre cette voie. Si c'est l'édition plutôt que la génération qu'il vous faut, Qwen-Image-Edit, ouvert, est le membre de la famille resté ouvert.
La seule comparaison que nous ne pouvons pas faire sérieusement est celle de la qualité. Sans benchmarks, sans rapport technique et sans test pratique de notre part, classer la 3.0 face à Seedream, Nano Banana ou Midjourney sur la qualité d'image reviendrait à inventer un résultat. Nous trancherons une fois que nous l'aurons fait tourner, et pas avant.
Ce que nous pouvons rapporter, c'est que les premières réactions pratiques indépendantes n'ont pas été enthousiastes. Les testeurs qui l'ont comparé aux modèles phares actuels ont continué à placer GPT Image en premier et Seedream en deuxième, avec pour résumé qu'un modèle fermé sorti sans rapport ne leur donne aucune raison particulière de changer. Un testeur a aussi signalé des erreurs visibles dans la vitrine d'Alibaba elle-même, de petits artefacts d'icônes dans une maquette d'interface générée, et soulevé une question que nous ne pouvons pas trancher : on ne sait pas si le Qwen Studio public sert la 3.0 ou une version antérieure, ce qui rend les premières impressions rapides peu fiables. Ce sont des impressions individuelles et non un benchmark mesuré : pesez-les comme telles.
The model showdown
Every image model on this site runs the same six prompts across three tiers (SFW, erotic and explicit) on the same rig, with no cherry-picking and no retouching. Below is what Qwen-Image-3.0 returned, graded against a fixed rubric so the results mean the same thing from one model page to the next.
- Run on
- OpenRouter, qwen/qwen-image-3, POST /api/v1/images
- Date
Why these six prompts? ▾Why these six prompts? ▴
They are chosen to break things, across three tiers so a model that refuses NSFW outright still gets a fair, comparable test. The SFW tier stacks two-person contact, readable logo text on folded fabric and genuine expressions with teeth. The erotic tier stacks the four failure modes that mark an image as machine-made at a glance: hands, fine text on skin, a mirror that has to obey geometry, and three distinct character designs in one frame. The explicit tier exists to test the same anatomical limits at full intensity, but its output is never published on this site.
No model passes every check, and not every model can attempt every tier. That is the point. A rubric everything passes tells you nothing about which model to reach for on a Tuesday afternoon.
Test de détail SFW
Two people, bright kitchen
Two subjects interacting in hard morning light, with a brand logo on fabric that has to stay readable while the fabric folds. Tests skin-on-skin contact, genuine expressions with teeth, and text rendering on a non-flat surface. Fully clothed throughout.

Scorecard
- Pass: Both faces free of uncanny artifacts
- Pass: Logo text legible on folded fabric
- Pass: Teeth and open-mouth expressions natural
- Pass: Contact points between subjects anatomically sane
What we saw
Clean on every check: legible logo (the heart glyph is a little off-model but the wordmark and gradient are right), artifact-free faces, genuine laughter, sane contact points.
Goth bride, cathedral
Not published for Qwen-Image-3.0. The run either failed the site’s content rules or has not happened yet, and a substitute image from another model would defeat the entire purpose of the test.
Palier érotique
Solo portrait, beach
Not published for Qwen-Image-3.0. The run either failed the site’s content rules or has not happened yet, and a substitute image from another model would defeat the entire purpose of the test.
Three characters, anime, night
Stylized rendering with three distinct character designs in one frame, water and reflections, bare-foot anatomy, and two animals. Multi-subject scenes are where most image models quietly give up.

Scorecard
- Pass: Three distinct, non-cloned character designs
- Partial: Feet and toes rendered correctly
- Pass: Water surface and reflections coherent
- Pass: Both animals recognizable and correctly anatomized
What we saw
Three distinct designs, correct single cat and single dog. The standout detail is the neon signage in the background renders as real, legible Japanese (新宿 / 東京), which no other model in this batch managed. Feet are clear on two of the three women but less defined on the center figure.
Palier explicite
Queued. We only mark this tier complete once a human has verified a real run for this model, and that hasn't happened yet.
Questions fréquentes
- Qwen-Image-3.0 est-il open source comme les versions précédentes ?
- Non. Qwen-Image 1.0 et 2.0 sont sortis avec des poids ouverts sous licence Apache-2.0 et des rapports techniques le jour même. Qwen-Image-3.0, lancé le 21 juillet 2026, est uniquement hébergé : pas de poids téléchargeables, pas de licence, pas de fiche de modèle et pas de benchmarks. Si vous utilisiez Qwen pour l'héberger en local, la 3.0 n'est pas une mise à niveau directe. Pour une voie ouverte et auto-hébergeable, notre guide Z-Image explique comment faire tourner un modèle open-weight en local, et Qwen-Image-Edit (20B) d'Alibaba, publié séparément, reste ouvert pour l'édition.
- Qu'est-ce qui a changé dans Qwen-Image-3.0 ?
- Le changement principal annoncé est la fenêtre de prompt, portée à environ 4 500 tokens contre environ 1 000 pour la 2.0, ce qui lui permet de rendre en une seule passe des travaux denses de texte et de mise en page : affiches multilingues, infographies à plusieurs panneaux, maquettes d'interface, storyboards. Il revendique aussi un rendu de texte natif dans 12 langues et plus de 20 polices, lisible jusqu'à une dizaine de pixels. Tous ces chiffres sont annoncés par l'éditeur ; aucun benchmark publié ne les confirme.
- Combien coûte Qwen-Image-3.0 et où l'utiliser ?
- Fin juillet 2026, il est disponible via les applications Qwen Chat et Qwen Studio et une API Alibaba sur invitation, et Alibaba n'a pas publié de tarifs. L'accès étant restreint et aucun coût ni plafond d'usage n'étant indiqué, le vrai prix par image et les éventuelles limites se découvrent dans le produit. Quiconque cite un prix exact ou un quota gratuit se trompe probablement : aucun n'a été publié.
- Dois-je passer d'un modèle open-weight à Qwen-Image-3.0 ?
- Seulement si votre besoin précis est du texte dense et lisible et des mises en page complexes en une seule passe, ce pour quoi la 3.0 est conçue, et si un modèle fermé et hébergé est acceptable dans votre pipeline. Si vous comptez sur la génération locale, l'absence de compte, l'absence de télémétrie ou un coût par image prévisible, la 3.0 retire tout cela par rapport aux versions ouvertes précédentes de Qwen : c'est un pas de côté plutôt qu'un pas en avant. Nous ne pouvons pas encore comparer sa qualité d'image aux alternatives, faute de benchmarks et de test pratique de notre part.
Guides pratiques
Modèles liés
Recevez les nouveaux guides par email
Un email quand nous publions de nouveaux guides et analyses de modèles. Pas de spam, désinscription à tout moment.
