Qwen
La famille de modèles d'Alibaba, la plus complète en open-weights en 2026. Voici ce qu'elle propose aujourd'hui, d'après ce qu'annonce Alibaba : cœur ouvert, modes de pensée hybrides, plus de 100 langues et dialectes, prix API, forts et limites.
En bref
Qwen est, selon Alibaba, la famille la plus complète en open-weights en 2026 : des poids Apache 2.0 sur texte, code, vision et raisonnement, et un modèle ouvert de 235 Md en Mixture-of-Experts, dont 22 Md actifs. Elle propose des modes de pensée hybrides (« Thinking » / « Non-Thinking ») pour arbitrer perf, vitesse et coût, couvre plus de 100 langues et dialectes et supporte MCP. À savoir, pour rester honnête : si le cœur est bien Apache 2.0, Qwen3.5-Omni et Qwen3.6-Plus sont propriétaires, tout comme le dernier Qwen3.7-Max (20 mai 2026).
01 C'est quoi
Une famille de modèles large et majoritairement ouverte. Alibaba met en avant trois axes.
Cœur open-weights
Poids Apache 2.0 sur texte, code, vision et raisonnement. Qwen3-235B-A22B, 235 Md de paramètres dont 22 actifs, est ouvert et auto-hébergeable.
Pensée hybride
Modes « Thinking » et « Non-Thinking » pour arbitrer performance, vitesse et coût. plus de 100 langues et dialectes et support MCP.
Qwen 3.7
Qwen3.7-Max (proprio, 20 mai 2026) et Qwen3.7-Plus, agent multimodal (1er juin 2026). Top scores annoncés sur Terminal-Bench 2.0, SWE-Bench Pro et MCP-Atlas.
02 Comment ça marche
Qwen mène deux vies : une famille de poids ouverts d'un côté, une plateforme qui héberge ses propres concurrents de l'autre.
- Le prix affiché de son modèle amiral est promotionnel. La grille annonce Qwen3.7-Max au prix catalogue de 2,50 dollars en entrée et 7,50 en sortie par million de tokens, avec une remise limitée dans le temps de 50 %. Tu paies donc 1,25 et 3,75, mais c'est une promotion : le prix de référence est le double.
- Le tarif dépend de la longueur du contexte. Qwen3.7-Plus coûte 0,40 et 1,60 dollar par million jusqu'à 256 000 tokens, puis 1,20 et 4,80 au-delà, soit trois fois plus. Qwen3.6-Flash suit la même logique, de 0,25 et 1,50 à 1 et 4. Le long contexte se paie.
- La plateforme sert les modèles des autres. C'est le fait le plus révélateur du catalogue : à côté des modèles Qwen, Model Studio héberge DeepSeek V4 Pro et Flash, Kimi K2.7 Code, GLM-5.2 et MiniMax-M2.5. Alibaba ne vend pas seulement ses modèles, il vend l'accès à ceux de ses concurrents.
- Elle parle trois langues d'API. Le format OpenAI, le format Anthropic et son format maison DashScope. Un outil écrit pour l'un ou l'autre écosystème peut pointer vers Qwen sans être réécrit.
- Le déploiement est mondial. Six régions sont annoncées : Pékin, Hong Kong, Singapour, Tokyo, Francfort et la Virginie. Francfort compte pour qui a une contrainte de résidence européenne des données.
- Les modèles ouverts n'activent qu'une fraction d'eux-mêmes. Qwen-AgentWorld, par exemple, compte 35 milliards de paramètres mais n'en active que 3 par token, répartis sur 256 experts. Son contexte atteint 262 144 tokens.
La famille couvre bien plus que le texte : génération d'images avec qwen-image-2.0-pro et wan2.7-image-pro, vidéo avec la série happyhorse, reconnaissance vocale et parole à parole avec qwen3.5-omni-plus-realtime, plus l'embarquement et le reclassement avec text-embedding-v4 et qwen3-rerank.
03 Ce que ça sait faire
Capacités annoncées par Alibaba, reprises telles quelles.
✓ Ce qui est annoncé fort
- ✓Ouverture : cœur sous Apache 2.0, dont un modèle de 235 Md à 22 Md actifs, auto-hébergeable.
- ✓Multilingue : plus de 100 langues et dialectes, avec support du protocole MCP.
- ✓Pensée hybride : on dose perf, vitesse et coût selon la tâche.
- ✓Coût maîtrisé : Qwen3.7-Max à 1,25 $ / 3,75 $ par M en promo (-50 %).
04 Ce que ça ne sait pas faire
Les contraintes réelles, dont plusieurs tiennent à ce que les pages officielles ne montrent pas.
- La remise de 50 % est explicitement temporaire. Le prix de référence de Qwen3.7-Max est de 2,50 et 7,50 dollars par million de tokens. Bâtir un budget sur le tarif promotionnel revient à parier sur sa reconduction.
- Les modèles les plus récents ne sont pas ouverts. L'ouverture concerne le cœur de la famille, pas le haut de gamme servi en API. Qwen3.7-Max, Qwen3.6-Plus et Qwen3.5-Omni s'utilisent via le web ou Alibaba Cloud, pas en auto-hébergement.
- Le site produit est illisible pour un outil. qwen.ai est une application rendue côté client : une lecture automatique n'en retire que le titre. La documentation exploitable vit sur Alibaba Cloud, sous une forme entreprise.
- La licence n'est pas documentée là où on la cherche. Ni le site produit ni la page des modèles d'Alibaba Cloud ne mentionnent de licence. Elle ne se vérifie que sur les dépôts de modèles, un par un.
- Le nommage est instable. La page des modèles liste Qwen3.7-Max, quand la page de facturation fait aussi apparaître un Qwen3-Max, avec une grille tarifaire différente par paliers de 32K, 128K et 256K. Aucune des deux pages n'explique la relation entre les deux.
- Les fenêtres de contexte ne sont pas annoncées. La page des modèles n'en publie aucune ; elles ne se devinent qu'indirectement, à travers les paliers de facturation.
05 Les versions
Trois modèles de texte servis en API, une famille ouverte à côté, et des concurrents hébergés sur la même plateforme.
- Qwen3.7-Max
- Le modèle amiral. Prix catalogue de 2,50 $ et 7,50 $ par million de tokens, ramenés à 1,25 $ et 3,75 $ par une remise limitée dans le temps de 50 %.
- Qwen3.7-Plus
- 0,40 $ et 1,60 $ par million jusqu'à 256 000 tokens, puis 1,20 $ et 4,80 $ au-delà. Il gère aussi la compréhension d'images et de vidéos.
- Qwen3.6-Flash
- 0,25 $ et 1,50 $ par million jusqu'à 256 000 tokens, puis 1 $ et 4 $ au-delà. Le palier économique.
- Les poids ouverts
- Sous licence Apache 2.0, vérifiée sur les dépôts officiels. Qwen-AgentWorld, par exemple, compte 35 milliards de paramètres dont 3 actifs, avec un contexte de 262 144 tokens.
- Au-delà du texte
- Images avec
qwen-image-2.0-pro, vidéo avec la sériehappyhorse, voix avecqwen3.5-omni-plus-realtime, embarquement avectext-embedding-v4. - Les modèles des autres
- La même plateforme sert DeepSeek V4 Pro et Flash, Kimi K2.7 Code, GLM-5.2 et MiniMax-M2.5.
06 Prix & accès
Des poids ouverts gratuits à héberger, et une API facturée par million de tokens.
Tarifs en date de juillet 2026. Les prix, offres et quotas affichés correspondent à l'état documenté à cette date. Ils peuvent évoluer ; consulte la source officielle citée sur la page avant achat.
- Poids Apache 2.0 · 0 $
- Le cœur de la famille est auto-hébergeable gratuitement.
- API Qwen3.7-Max · promo
- 1,25 $ / M en entrée, 3,75 $ / M en sortie (-50 %).
- API Qwen3.7-Max · liste
- 2,50 $ / M en entrée, 7,50 $ / M en sortie.
- Modèles propriétaires
- Qwen3.5-Omni et Qwen3.6-Plus via le web ou Alibaba Cloud.
Prix annoncés par Alibaba. Les poids ouverts sont auto-hébergeables gratuitement ; l'API facture par million de tokens et certains modèles restent propriétaires. Vérifie la grille officielle avant de t'engager.
07 Quand le choisir
Qwen n'est pas le meilleur partout. Il brille sur un usage précis.
- Tu veux un modèle ouvert de premier plan, à héberger toi-même.
- Tu as un besoin multilingue : la famille couvre plus de 100 langues et dialectes.
- Tu cherches un coût maîtrisé en API ou en auto-hébergement.
- Tu veux arbitrer perf, vitesse et coût avec les modes de pensée hybrides.
08 Alternatives
Aucun modèle n'est le meilleur partout. Le bon choix dépend de ton besoin.
Llama
L'écosystème open-weight le plus déployé de Meta. Autre choix pour l'auto-hébergement.
Recherche sourcéePerplexity
Un moteur de réponse qui cite ses sources. Autre approche que le modèle brut à héberger.
Code au quotidienClaude Sonnet 5
Notre modèle de travail au quotidien via Claude Code. Fermé mais très solide sur le code.
09 Verdict
Qwen s'impose comme l'une des familles ouvertes les plus complètes de 2026 : son cœur est sous Apache 2.0, avec un modèle de 235 milliards de paramètres dont 22 actifs, et plus de 100 langues et dialectes annoncés. Deux réserves comptent. La première est que tout n'est pas ouvert : les modèles servis en API, dont Qwen3.7-Max, sont propriétaires. La seconde tient au prix : le tarif affiché de Qwen3.7-Max est une promotion de 50 % explicitement limitée dans le temps, et le prix de référence est le double.
- Ouverture et multilinguisme : ses points forts.
- Pensée hybride et coût maîtrisé.
- À anticiper : les modèles les plus récents de la famille sont propriétaires.
10 Questions fréquentes
Qwen, c'est quoi ?
La famille de modèles d'Alibaba, la plus complète en open-weights en 2026, avec des poids Apache 2.0 sur texte, code, vision et raisonnement. Qwen3-235B-A22B, un modèle en Mixture-of-Experts de 235 milliards de paramètres dont 22 actifs, est ouvert sous Apache 2.0.
Qwen est-il open source ?
Le cœur de la famille est ouvert sous licence Apache 2.0, donc auto-hébergeable. En revanche, Qwen3.5-Omni, Qwen3.6-Plus et Qwen3.7-Max sont propriétaires, accessibles via le web ou Alibaba Cloud.
Combien coûte l'API Qwen ?
Selon Alibaba, Qwen3.7-Max est facturé 1,25 $ en entrée et 3,75 $ en sortie par million de tokens en promotion (-50 %), soit un prix de liste de 2,50 $ / 7,50 $. Les poids ouverts restent auto-hébergeables gratuitement. Tarifs en date de juillet 2026.
À quoi servent les modes de pensée ?
Les modes hybrides « Thinking » et « Non-Thinking » arbitrent entre performance, vitesse et coût selon la tâche. La famille couvre plus de 100 langues et dialectes et supporte le protocole MCP.
Sources primaires consultées le 16 juillet 2026 : qwen.ai pour le produit, Alibaba Cloud Model Studio pour le catalogue des modèles, sa page de facturation pour les tarifs, et la carte du modèle Qwen3-235B-A22B pour la licence, la taille et le nombre de langues. Ni le site produit ni la page des modèles ne documentent de licence : elle ne se vérifie que sur les dépôts, modèle par modèle.
Choisis le bon LLM
Compare Qwen aux autres modèles, ou apprends à écrire un prompt qui va droit au but.