G
GEO Toolbox
what-is-qwenqwenqwen3alibabatongyi-qianwenopen-weightschinese-aillmguide

C’est quoi Qwen ? L’IA d’Alibaba cachée dans vos outils

L’IA ouverte la plus téléchargée au monde est chinoise et vous ne la connaissez pas : Qwen d’Alibaba. Modèles open weights, licences, fiabilité et visibilité IA.

Samy Ben SadokSamy Ben Sadok25 min de lecture
Dans cet article13 sections

Rien qu’au nombre de téléchargements, Qwen est le modèle d’IA ouvert le plus populaire au monde, et la plupart des professionnels du marketing n’en ont jamais entendu parler. Les modèles ouverts d’Alibaba sont téléchargés, retravaillés et intégrés si largement dans les produits d’autres développeurs que Qwen peut se glisser dans des outils que vous n’associeriez jamais à un géant technologique chinois. Voici, en clair, ce qu’est Qwen (à jour en août 2026), qui le développe, sa fiabilité et sa place sur le marché. Puis la partie que les articles techniques passent sous silence : ce que le modèle ouvert le plus téléchargé implique pour la façon dont les outils d’IA décrivent votre marque.

Ce qu’il faut retenir

  • Qwen est la famille de modèles d’IA d’Alibaba Cloud (nom chinois : Tongyi Qianwen), publiée en grande partie en open weights, et la famille de modèles ouverts la plus téléchargée au monde depuis janvier 2026.
  • La majeure partie de la gamme est téléchargeable, le plus souvent sous licence Apache 2.0, mais la génération 3.7 (Max et Plus) est restée fermée, accessible uniquement via l’API ; la lignée Apache 2.0 allait jusqu’à Qwen3.6, avant de reprendre en août 2026 avec Qwen3.8-27B.
  • Qwen3.8-Max est le produit phare depuis le 3 août 2026 : 2 400 milliards de paramètres dont 95 milliards actifs, contexte d’un million de tokens, multimodal, avec cette fois un tableau de benchmarks publié (par l’éditeur lui-même). Alibaba a publié les poids le 12 août 2026, une première pour un modèle Max, mais une ouverture partielle : version texte seul, contexte natif de 262 144 tokens, sous une licence maison « Qwen3.8-Max », pas Apache 2.0.
  • Le chatbot Qwen et Qwen Studio sont gratuits ; l’API Qwen3.8-Max est facturée en dollars (2 $ en entrée / 6 $ en sortie par million de tokens, hors TVA française), une fraction du prix des modèles occidentaux fermés.
  • Point sensible en France : les prompts envoyés à l’app ou à l’API hébergées transitent par les serveurs d’Alibaba, sous juridiction chinoise, et l’auto-hébergement des poids ouverts reste la parade qui offre le plus de contrôle. La Direction générale du Trésor a d’ailleurs débranché un pilote Qwen mi-2026, non pas pour une fuite de données (le pilote tournait en mode déconnecté), mais pour l’origine et les biais du modèle.

Qu’est-ce que Qwen ?

Qwen est la famille de modèles d’IA d’Alibaba Cloud, publiée pour l’essentiel en open weights et connue en Chine sous le nom de Tongyi Qianwen. Ce n’est pas un modèle unique mais une gamme entière, avec des versions pour le texte, le code, la vision, la génération d’images et l’audio. Si vous avez déjà fait tourner un modèle en local sur votre ordinateur, parcouru un classement de « modèles ouverts » ou utilisé un outil d’IA qui basculait en coulisses vers un moteur moins cher, il y a de fortes chances que Qwen ait été de la partie.

Comme les autres modèles ouverts, Qwen est en réalité trois choses, et bien les distinguer dissipe l’essentiel de la confusion. Il y a les poids ouverts, qu’Alibaba publie pour que chacun puisse télécharger, exécuter et affiner les grands modèles de langage (LLM). Il y a le produit hébergé, le chatbot gratuit Qwen et Qwen Studio sur qwen.ai, qu’Alibaba fait tourner sur ses propres serveurs. Et il y a l’API, que les développeurs appellent pour bâtir leurs propres produits. Les modèles sont en grande partie ouverts ; le service qui les entoure appartient à Alibaba.

Si la plupart des professionnels du marketing n’ont jamais entendu parler de Qwen malgré son envergure, c’est qu’il vit avant tout comme une infrastructure, pas comme une marque grand public. Il n’a pas la notoriété d’un ChatGPT. Il se loge sous le capot d’autres produits, retravaillé et rebaptisé jusqu’à ce que le nom d’Alibaba disparaisse. Toute l’histoire est là, et c’est exactement pour cela que Qwen mérite votre attention, même si vous n’y saisissez jamais un prompt.

C'est l'IA d'Alibaba, prononcée « chwen »

« Qwen » se prononce généralement « chwen ». C’est la famille de modèles d’IA d’Alibaba, pas le joueur de football américain dont le nom est souvent mal orthographié dans le même champ de recherche, ni le fauteuil d’appoint qui s’écrit de la même façon. Dans cet article, « Qwen » désigne l’IA d’Alibaba.

Qui est derrière Qwen ? Alibaba et l’équipe Tongyi Qianwen

Qwen vient d’Alibaba Cloud, construit par l’équipe à l’origine de Tongyi Qianwen, et cette filiation est la première chose qui le distingue. Alibaba a lancé la première bêta de Qwen en 2023 et n’a cessé depuis de sortir de nouveaux modèles à un rythme effréné, avant d’en faire une unité dédiée au sein de l’entreprise.

C’est un acteur d’un tout autre genre que les laboratoires chinois croisés dans l’actualité. DeepSeek est né d’un fonds spéculatif quantitatif, Kimi de la start-up Moonshot, GLM de Zhipu. Qwen vient de l’une des plus grandes entreprises technologiques de la planète. C’est un programme de modèles ouverts porté par un géant du secteur, pas une jeune pousse débrouillarde, et cela se voit autant dans l’étendue de la gamme que dans la stratégie qui la sous-tend.

Cette stratégie est celle, familière, de Meta et Google avec leurs modèles ouverts : donner les modèles pour gagner les développeurs, et se rémunérer sur le cloud et les produits en aval. Alibaba y va franchement. L’entreprise publie la majeure partie de la gamme en téléchargement gratuit, et branche aussi Qwen sur son propre écosystème, où il alimente des fonctionnalités de ses plateformes de commerce en ligne et de voyage. Les modèles gratuits créent l’habitude ; le cloud payant et l’API phare sont censés rentabiliser l’ensemble.

La famille Qwen : un seul nom, des dizaines de modèles

Le plus dur, avec Qwen, c’est qu’il n’existe pas un seul « Qwen ». Il y en a des dizaines, sur plusieurs générations, derrière un mur de suffixes : Qwen2.5, Qwen3, Qwen3.5, Qwen3.6, Qwen3.7, Qwen3.8, avec des étiquettes comme Max, Plus, Coder, VL, Image et Omni qui reviennent dans toute la famille, pour des tailles allant de moins d’un milliard de paramètres à plusieurs centaines de milliards. Si vous vous êtes senti perdu à chercher quel Qwen est « le » Qwen, c’est la conception qui veut ça : vous n’y êtes pour rien.

Le fil conducteur reste simple. La série est partie du Qwen original en 2023, a traversé Qwen2 et Qwen2.5, puis Qwen3 en avril 2025, qui a ajouté un mode de raisonnement (« Think ») hybride permettant au modèle de basculer entre réponses rapides et raisonnement pas à pas. De là, elle a filé vers Qwen3.5, Qwen3.6 et Qwen3.7 jusqu’au produit phare actuel, Qwen3.8-Max, sorti le 3 août 2026. La famille est entraînée sur bien plus de 100 langues, ce qui explique en partie son adoption massive hors du monde anglophone.

Qwen3.8-Max est un modèle multimodal de 2 400 milliards de paramètres, dont 95 milliards actifs par token, avec une fenêtre de contexte d’un million de tokens. Alibaba l’avait montré en préversion à la World AI Conference de Shanghai le 19 juillet, avant de le lancer officiellement deux semaines plus tard en le présentant comme « le modèle le plus performant de la famille Qwen à ce jour ». Il s’appelle qwen3.8-max côté API et coûte 2 $ par million de tokens en entrée, 6 $ en sortie. Contrairement à la préversion, il s’accompagne d’un tableau de benchmarks, mais à méthodologie mixte : Alibaba a évalué Qwen lui-même et repris plusieurs scores concurrents auprès de tiers. Les poids, promis pour la semaine du 10 août, sont arrivés le 12 août 2026 sur le dépôt officiel Qwen3.8-2.4T-A95B : une première pour la gamme Max, mais une ouverture partielle, en version texte seul, au contexte natif de 262 144 tokens (extensible à environ un million), sous une licence maison « Qwen3.8-Max » distincte d’Apache 2.0.

Ce qui distingue Qwen de ses rivaux ouverts, c’est l’étendue. Là où DeepSeek, Kimi et GLM sont pour l’essentiel des modèles de texte et de code, Qwen est une famille multimodale complète. Voici les principales lignes en août 2026.

Ligne Qwen (en août 2026)Ce qu’elle faitPoids ouverts ?
Qwen3.6 (dense + MoE)Texte et raisonnement généraux, mode Think hybride ; la lignée ouverte actuelle, les modèles que la plupart des gens font réellement tournerOui (Apache 2.0)
Qwen3.8-MaxLe produit phare actuel : 2 400 milliards de paramètres dont 95 milliards actifs, contexte de 1 million, multimodalOui, depuis le 12 août 2026 : version texte seul (contexte natif 262 144 tokens), licence maison « Qwen3.8-Max », pas Apache 2.0
Qwen3.7-MaxLe produit phare précédent, contexte de 1 million, toujours commercialisé ; tarif catalogue supérieur à celui du 3.8-Max, mais moins cher tant que dure sa promotion de 50 %Non (API uniquement)
Qwen3.7-PlusMultimodal de milieu de gamme : compréhension image et vidéo, raisonnement poussé, pilotage d’interfaces graphiques et tâches agentiques, contexte de 1 millionNon (API uniquement)
Qwen-CoderCodage et tâches logicielles agentiquesOui (versions ouvertes)
Qwen-VLVision : lecture et raisonnement sur images et vidéosOui (versions ouvertes)
Qwen-ImageGénération et retouche d’imagesOui (versions ouvertes)
Qwen-OmniTexte, image, audio et vidéo ensemble, avec voix en temps réel ; les versions commerciales actuelles sont qwen3.5-omni-plus et sa variante temps réelMixte (certaines ouvertes, d’autres non)

Qwen est-il open source ? La réalité ouvert/fermé

Liste des lignes de modèles Qwen en août 2026 : Qwen3.6 est publié sous licence Apache 2.0 et Qwen-Coder, Qwen-VL et Qwen-Image disposent de versions ouvertes, tandis que le modèle phare Qwen3.8-Max a publié ses poids le 12 août 2026 en version texte seul sous licence maison « Qwen3.8-Max », et que Qwen3.7-Max et Qwen3.7-Plus restent fermés et accessibles uniquement via l'API.
La plupart des lignes Qwen sont téléchargeables, mais pas les gammes 3.7, et l’ouverture du modèle phare du 12 août reste partielle : texte seul, sous licence maison.

Qwen, c’est l’histoire du modèle ouvert avec un bémol : l’essentiel de la famille est réellement ouvert, mais le meilleur modèle qu’elle contient ne l’est pas. C’est un point qui piège beaucoup de monde, et il vaut la peine d’être clarifié, car « Qwen est-il encore open source ? » est devenu une vraie question dans la communauté.

Le détail, sans détour. La majeure partie de la gamme Qwen, les modèles denses et beaucoup des modèles Mixture-of-Experts, est publiée en poids ouverts sous la licence permissive Apache 2.0. Vous pouvez les télécharger, les faire tourner sur votre propre matériel, les affiner et les utiliser à des fins commerciales, sous les seules conditions légères de la licence Apache 2.0. C’est la partie qui a bâti la réputation de Qwen. Mais la gamme phare « -Max », de Qwen3-Max à Qwen3.7-Max puis, jusqu’au 12 août 2026, à l’actuel Qwen3.8-Max, était propriétaire : elle ne tournait que via l’API d’Alibaba, sans téléchargement possible. Alibaba suivait ce schéma depuis Qwen2, en ouvrant l’essentiel de la gamme tout en gardant son modèle le plus performant fermé.

Ce bémol a pris de l’ampleur, avant de se résorber en partie. La génération 3.7 est restée fermée : Qwen3.7-Max en mai 2026 et Qwen3.7-Plus début juin, tous deux uniquement via l’API, et leurs poids ne sont jamais venus. Qwen3.8-Max semblait devoir suivre, jusqu’au 12 août 2026, date à laquelle Alibaba a publié ses poids (texte seul, sous licence maison « Qwen3.8-Max », pas Apache 2.0) : le premier Max ouvert, même si la version multimodale complète du modèle phare lui-même reste API uniquement. Un modèle distinct, plus petit, a comblé cet écart deux jours plus tard : Qwen3.8-27B, un modèle vision-langage de 27 milliards de paramètres, publié vers le 14 août 2026 en poids ouverts sous la licence Apache 2.0 classique — un Qwen à la fois vraiment ouvert et vraiment multimodal existe donc désormais, juste pas à l’échelle du modèle phare. Pour la 3.6, les poids avaient suivi l’API en quelques semaines ; la génération 3.7 ne les a jamais eus. Ce qui reste fermé, c’est le palier intermédiaire « -Plus », Qwen3.7-Plus et ses successeurs, la taille vers laquelle se tourneraient la plupart des développeurs avant de passer à un modèle phare de 2 400 milliards de paramètres : il reste API uniquement, même maintenant que le modèle phare s’est en partie ouvert. En revanche, Alibaba n’a pas ralenti ses publications ouvertes ailleurs, avec des poids sous Apache 2.0 pour des modèles d’agents, d’embedding et de robotique tout au long de juin et juillet 2026.

C’est le lancement de la 3.8 qui met cette habitude à l’épreuve. Le billet de sortie annonce la publication des poids de Qwen3.8-Max dans la semaine du 10 août 2026 et présente l’opération comme la première ouverture d’un modèle de la gamme Max. C’était une rupture nette avec trois ans de pratique, raison de plus pour vérifier plutôt que de supposer, et la vérification a fini par tourner en faveur d’Alibaba : avec deux jours de retard sur la fenêtre annoncée, les poids sont arrivés le 12 août 2026 dans l’organisation Hugging Face officielle. L’ouverture reste partielle : la variante publiée est texte seul, son contexte natif s’arrête à 262 144 tokens, et la licence est une licence maison « Qwen3.8-Max », pas l’Apache 2.0 du reste de la famille. Les dépôts tiers apparus avant cette date ne contenaient rien, ou d’anciens modèles rebaptisés : seul le compte officiel d’Alibaba fait foi.

La question des licences complique encore un peu le tableau. La plupart des modèles ouverts sont en Apache 2.0 sans condition, mais quelques-uns relèvent de la licence Qwen, qui impose de demander une licence à Alibaba dès qu’un produit dépasse 100 millions d’utilisateurs actifs par mois, et les plus petites variantes de recherche sont non commerciales. Et comme pour tout modèle de cette catégorie, « poids ouverts » n’est pas « open source » : Alibaba publie les poids finaux, pas les données d’entraînement ni la recette complète.

NiveauExempleTéléchargeable ?Licence
Denses + MoE ouvertsQwen3.6-35B-A3B, Qwen3.6-27BOuiApache 2.0 (sans condition)
Certains poids plus gros / plus anciensQwen2-72BOuiLicence Qwen (clause des 100M d’utilisateurs actifs mensuels)
Petites variantes de rechercheQwen2.5-3BOuiQwen Research (non commercial)
Modèle phare « -Max »Qwen3.8-MaxOui (12 août 2026), texte seulLicence maison « Qwen3.8-Max » pour les poids ; la version multimodale complète reste API uniquement
Multimodal ouvert (taille moyenne)Qwen3.8-27BOui (~14 août 2026), vision-langageApache 2.0 (sans condition)

Parce qu’une grande partie de Qwen est accessible gratuitement sous licence permissive, il est téléchargé, affiné et décliné en une multitude de versions communautaires rebaptisées, y compris des versions modifiées pour retirer les garde-fous. Gardez ce point en tête. C’est celui qui compte pour votre marque, et nous y revenons à la fin.

Qwen est-il vraiment performant ? Qwen3.8-Max et le tableau réaliste

En août 2026, le modèle phare Qwen3.8-Max joue dans la cour des grands, du moins selon les chiffres d’Alibaba, mais l’histoire la plus utile reste celle des modèles ouverts. La sortie de la 3.8 s’est enfin accompagnée d’un tableau de benchmarks, ce que la préversion de juillet n’avait pas, et il mérite mieux qu’une lecture en diagonale. Alibaba y place Qwen3.8-Max à 86,6 sur Terminal-Bench 2.1, devant Claude Fable 5 à 84,6, et à 92,6 sur GPQA Diamond, à égalité avec Fable 5. Le même tableau le montre nettement distancé sur les épreuves les plus dures : 67,7 contre 80,0 pour Fable 5 sur SWE-bench Pro, et 43,6 contre 53,3 sur Humanity’s Last Exam. Autrement dit, un bon modèle qui perd plusieurs des comparaisons que son propre éditeur a choisi de publier, ce qui est déjà plus honnête que le positionnement « juste derrière Claude Fable 5 » qui avait suivi la préversion de juillet.

Les mesures extérieures sont encore moins flatteuses. Artificial Analysis fait tourner Terminal-Bench 2.1 de façon indépendante et attribue 81,3 % à Qwen3.8-Max, soit en dessous des 84,6 % de Fable 5, et non au-dessus. L’explication tient à la méthode, et Alibaba l’assume : sur cette épreuve, il a évalué Qwen lui-même et repris pour chaque concurrent le meilleur score publié ailleurs. Son tableau confronte donc une mesure maison à celles des autres. La même réserve vaut pour sa comparaison entre générations, où le chiffre de Qwen3.7-Max est importé quand celui de Qwen3.8-Max ne l’est pas : quand Artificial Analysis mesure les deux générations, le gain va de 74,5 % à 81,3 %. Voilà pourquoi un benchmark d’éditeur se lit comme un point de départ, pas comme un verdict.

Les benchmarks ne disent d’ailleurs pas l’essentiel. Ce que le billet de lancement a de plus parlant relève de l’agentique : Alibaba affirme que Qwen3.8-Max a travaillé plus de dix jours sans supervision pour construire un projet en ligne de commande, avec 265 commits et 127 pull requests à la clé, et qu’il a consacré environ 125 heures à reproduire un article de recherche à partir du seul texte publié, avant d’en améliorer le résultat. Ce sont les comptes rendus d’Alibaba, que personne n’a reproduits, mais ils désignent bien ce qu’il faut tester : le travail long et autonome plutôt que la réponse unique.

En résumé : Qwen3.8-Max est un bon modèle multimodal et un modèle de code convenable, à une fraction du tarif des modèles de pointe, et rien de publié à ce jour n’en fait le meilleur modèle du monde.

Le résultat qui devrait impressionner un non-développeur est plus discret. Les modèles ouverts de Qwen, ceux que tout le monde peut télécharger gratuitement, se hissent régulièrement au-dessus de leur catégorie, face à des modèles bien plus gros et bien plus chers. C’est exactement pour cela que les développeurs les prennent par défaut, et c’est la vraie réussite de Qwen : non pas qu’un modèle phare fermé domine un classement pendant une semaine, mais que les modèles gratuits et téléchargeables soient assez bons pour construire dessus.

Qwen fonctionne-t-il bien en français ?

Oui pour l’usage courant, avec une nuance. Qwen est entraîné sur plus de 100 langues et gère le français sans accroc pour rédiger, résumer ou coder au quotidien ; c’est l’un de ses arguments face aux modèles anglophones. Sa force la plus durable reste toutefois le multilingue au sens large, chinois en tête, plus qu’une excellence spécifiquement française : sur la nuance éditoriale en français, des modèles comme Claude gardent une longueur d’avance, et l’écosystème francophone d’Alibaba (documentation, support, communauté) est quasi inexistant. Pour un texte français exigeant, Qwen dépanne ; pour un travail où le rendu compte, comparez-le à une option européenne comme Mistral avant de trancher.

Qwen est-il fiable ? La question chinoise et le RGPD

La réponse honnête tient à la même distinction que pour tout modèle chinois : qui fabrique le modèle et qui héberge vos données, à quoi s’ajoute une subtilité propre à Alibaba. Réglez le premier point et l’essentiel de l’inquiétude se dissipe.

Quand vous utilisez l’app ou l’API Qwen hébergées, vos prompts partent vers les serveurs d’Alibaba, ce qui les place sous juridiction chinoise et sous les règles de données qui vont avec. Tout modèle hébergé fait sortir vos prompts de vos murs, y compris chez un fournisseur américain ; la différence avec un fournisseur chinois, c’est la juridiction et la politique dont ils relèvent. Pour un travail sensible ou confidentiel, c’est un vrai critère, et c’est la même prudence que nous détaillons pour DeepSeek. La porte de sortie, ce sont les poids ouverts : comme l’essentiel de la famille est téléchargeable, une équipe peut faire tourner Qwen sur sa propre infrastructure, les prompts ne quittent jamais les locaux et l’hébergement chinois sort de l’équation. Pour les données à fort enjeu, auto-héberger plutôt qu’envoyer est la réponse la plus nette. Aucune action de la CNIL ni d’une autre autorité de protection des données n’a visé Qwen spécifiquement à ce jour, contrairement à DeepSeek, mais l’absence de sanction n’est pas un feu vert : c’est à vous d’évaluer la souveraineté de vos données.

L’autre point, ce sont les achats. Certaines organisations, surtout en environnement réglementé ou sensible, appliquent une règle générale « pas de modèle d’origine chinoise » ; c’est une règle de conformité, pas une contrainte technique. L’auto-hébergement résout la résidence des données, mais pas forcément une politique qui bannit le modèle par son origine, quel que soit son mode d’exécution. Le cas français est éloquent : en juin 2026, la Direction générale du Trésor (Bercy) a testé Qwen, sous le nom d’un outil interne baptisé « HéphAIstos », auprès d’une centaine d’agents, avant de le débrancher après des alertes sur des « biais chinois » dans certaines réponses, et de le remplacer par Mistral AI dès le lendemain. L’expérimentation tournait en mode déconnecté, sans fuite de données détectée : le blocage a porté sur l’origine et l’orientation du modèle, pas sur une faille technique, exactement le type de règle décrit plus haut. Autre aspect, côté contenu : l’app officielle suit les règles chinoises sur les sujets politiquement sensibles, et comme les poids sont ouverts, la communauté a même produit des forks « décensurés » qui retirent ces garde-fous, rappel de la distance que parcourent ces modèles une fois publiés.

Combien coûte Qwen et comment y accéder ?

Il y a trois portes d’entrée, et votre choix fixe le compromis entre coût et confidentialité. La plus rapide, c’est le chatbot gratuit Qwen et Qwen Studio sur qwen.ai, sans configuration, pour le texte, les images et le reste. Pour construire, l’API est compatible OpenAI : elle s’intègre aux outils existants en changeant à peine plus qu’un point de terminaison, et coûte bien moins que le haut de gamme occidental fermé. Et comme l’essentiel de la famille est ouvert, vous pouvez contourner les serveurs d’Alibaba et tout auto-héberger.

Mode d’accèsPrix (en août 2026)Ce que vous obtenez
Qwen Chat / Qwen StudioGratuitChat web texte et images, aucune configuration, le moyen le plus rapide d’essayer
API autonome (Qwen3.8-Max)2 $ en entrée / 6 $ en sortie par million de tokensIntégrer le modèle phare actuel à votre propre produit
API autonome (Qwen3.7-Max)2,50 $ en entrée / 7,50 $ en sortie par million de tokens au catalogue, avec actuellement une remise de 50 % dans le cadre d’une promotion à durée limitéeLe modèle phare précédent, moins cher que l’actuel tant que dure la promotion
Auto-hébergement (modèles ouverts)Licence gratuite, votre propre matérielLes données restent en local ; tourne du portable au serveur

Le tarif API du modèle phare sur OpenRouter reprend les 2 $ et 6 $ affichés par Alibaba, et le Qwen3.7-Max précédent descend sous ce niveau tant que sa promotion de 50 % s’applique. Dans tous les cas, on reste à une fraction de ce que facturent les meilleurs modèles fermés. Les tarifs promotionnels bougent, vérifiez donc le prix en direct avant d’arrêter votre budget. À noter pour les acheteurs français : Alibaba Cloud facture son API en dollars, et la TVA française (20 %) s’ajoute au tarif catalogue en USD, soit un montant final environ 20 % au-dessus de la simple conversion dollar-euro ; un concurrent comme Mistral facture, lui, nativement en euros. Les modèles ouverts vivent sur Hugging Face et ModelScope d’Alibaba, et tournent avec les outils locaux habituels comme Ollama et LM Studio, ce qui explique comment Qwen a atterri sur tant d’ordinateurs et de téléphones.

Qwen face à DeepSeek, Kimi, GLM et Llama

Dans un paysage open source très encombré, Qwen se distingue par l’étendue et la portée, pas par une victoire à un benchmark. Les autres modèles ouverts tendent à se spécialiser : DeepSeek est le spécialiste raisonnement et coût, Kimi penche vers l’agentique avec un contexte long, GLM mise sur le code, et le Llama de Meta est le pionnier occidental qui a lancé la vague des poids ouverts. Qwen est celui qui touche un peu à tout, sur le plus de modalités, avec le déploiement le plus large. Pour un comparatif complet en coût, ouverture et capacités, voyez notre comparatif des modèles d’IA chinois.

ModèleFabricantPoint fortPoids ouverts ?
QwenAlibabaÉtendue (texte, vision, image, audio), multilingue, portée bruteEn grande partie oui ; poids du phare texte seul depuis le 12 août (licence maison), version multimodale API uniquement
DeepSeekHigh-FlyerRaisonnement, mathématiques, coût très faibleOui (MIT)
KimiMoonshotTravail agentique, contexte longOui (modifié)
GLMZhipuCode, agents, tâches à long horizonOui (MIT)
LlamaMetaLe pionnier occidental de l’ouvert, vaste écosystèmeOui (licence Llama)

Pour la plupart des équipes, la bonne réponse n’est pas de couronner un modèle ouvert mais de retenir celui qui colle à la tâche, souvent en associant un modèle ouvert bon marché à un modèle fermé de pointe comme Claude ou GPT pour le plus dur. Ce qui rend Qwen important au-delà de ce menu, ce n’est pas sa place sur tel test. C’est le nombre d’endroits où il s’est déjà retrouvé, et c’est cela qui a de vraies conséquences pour votre marque.

Ce que Qwen change pour la visibilité de votre marque dans l’IA

La question que se posent vraiment la plupart des spécialistes du marketing, c’est de savoir s’ils doivent faire quelque chose au sujet de Qwen. La réponse courte est non, pas directement, et la raison tient à une distinction à garder en tête. Qwen est une infrastructure, pas une destination. On n'« optimise » pas pour Qwen comme on optimise une page pour Google. Alibaba fait bien tourner un chatbot Qwen, mais sur la plupart des marchés occidentaux vos acheteurs ne s’y renseignent pas sur vous ; ils sont sur ChatGPT, Perplexity, Gemini et Claude. C’est sur ces produits que vous suivez votre visibilité, et le lancement d’un seul modèle ouvert n’y change rien. Autant le dire clairement : être numéro un sur Google ne veut pas dire qu’un moteur d’IA vous citera, car c’est un système à part, avec sa propre logique.

Alors pourquoi Qwen revient-il sur la table ? Pour sa portée, avec une réserve. À la mi-août 2026, Alibaba a annoncé que la famille Qwen avait franchi 3 milliards de téléchargements cumulés, ce qui en fait la famille de modèles ouverts la plus téléchargée au monde, devant Meta comme devant Google. C’est le chiffre d’Alibaba, et il mérite une réserve honnête : le propre rapport State of Open Models de Hugging Face (août 2026) recense environ 2 milliards de téléchargements et quelque 151 000 modèles dérivés, contre les 300 000 et plus revendiqués par Alibaba. Quel que soit le décompte retenu, l’ordre de grandeur est le même, et aucune autre famille ouverte n’en approche. La plupart sont des développeurs qui font tourner Qwen pour du code, de l’inférence locale ou des fonctions backend qui ne décrivent aucune marque. Mais certains de ces déploiements s’adressent directement aux utilisateurs finaux : des assistants de chat, des bots de support et des surcouches de recherche discrètement bâtis sur Qwen, dont la portée est impossible à mesurer à partir d’un compteur de téléchargements et impossible à auditer. Vous ne pouvez pas inspecter chaque produit qui tourne dessus, forks communautaires compris, comme « Liberated Qwen », une version dépouillée de ses garde-fous. Voilà l’essentiel : un modèle ouvert aussi largement intégré s’intègre au substrat qui décrit votre marque là où vous ne regarderez jamais, non par malveillance, mais parce qu’il est partout et hors de contrôle une fois publié.

Cette omniprésence fait ressortir un second problème qu’il faut comprendre, et il vaut pour tout modèle, Qwen inclus. La mémoire interne d’une IA se périme, et pas seulement sur l’actualité de la semaine. Pour le montrer, en juin 2026 nous avons interrogé deux modèles connus, recherche web coupée, au sujet de Qwen. GPT-5.5 a reconnu de lui-même son incertitude et cité le « Qwen2-72B », vieux de deux ans, comme modèle phare. GPT-4o, plus ancien, a répondu avec aplomb que le dernier Qwen était « Qwen-7B » et que Qwen « est open source et gratuit », citant un modèle de 2023 et se trompant complètement sur la licence, puisque le vrai modèle phare était alors fermé (et la version multimodale complète l’est toujours, via l’API). Ce ne sont pas des ratés sur des nouveautés de dernière minute ; ces modèles se trompent sur les fondamentaux établis de Qwen, sa version actuelle et son caractère ouvert ou non.

La leçon ne porte pas vraiment sur Qwen. Pour une marque établie, le danger n’est presque jamais d’être invisible ; c’est d’être décrite comme une version dépassée d’elle-même, un ancien prix, un produit retiré, un nom d’avant votre changement d’image. Si un modèle peut se tromper à ce point sur un sujet qui cumule des centaines de millions de téléchargements, il peut se tromper sur votre dernière page.

Vous ne pouvez pas régler un seul modèle, encore moins chacun de ses forks. Ce que vous pouvez faire, c’est vous assurer que chaque moteur et chaque robot d’exploration accèdent bien à vos pages actuelles, et que vos informations concordent entre les sources qu’un modèle est susceptible de lire. Cette combinaison d’accessibilité et de cohérence est le fondement de l'optimisation pour les moteurs génératifs (GEO), et c’est le même mécanisme derrière les hallucinations de l’IA sur votre entreprise. À force de construire ce type d’outils, nous le constatons : les marques qui reviennent de façon fiable dans les réponses de l’IA ne sont pas celles qui ont la plus belle page d’accueil ; ce sont celles qu’un modèle peut trouver, analyser et considérer comme fiables sans buter sur une contradiction. Nos guides sur ce qu’est le GEO et comment les moteurs d’IA choisissent leurs sources creusent le sujet, et comme être cité par un moteur ne garantit jamais de l’être par le suivant, ce travail paie sur l’ensemble.

Qwen mérite qu’on le comprenne, mais la vague des modèles ouverts qu’il mène ne transforme pas tant votre métier qu’elle n’en élargit le terrain : plus d’endroits où une réponse à votre sujet peut surgir, plus de forks qui tournent discrètement dessous, plus d’occasions d’être décrit avec les faits de l’an dernier. Qwen n’est que le cas le plus net, parce que c’est celui qui s’est retrouvé partout. Le premier geste est aussi le moins cher, et il ne change pas selon le modèle qui tourne dessous : vérifiez si les robots d’IA parviennent ne serait-ce qu’à atteindre et lire vos pages actuelles. Vous pouvez calculer gratuitement votre score de préparation IA chez geotoolbox pour repérer ces lacunes avant que la prochaine réponse sur votre marque ne s’écrive sans vous.

Foire aux questions

Comment prononce-t-on « Qwen » ? Est-ce le footballeur ?

On dit généralement « chwen ». C’est la famille de modèles d’IA d’Alibaba, pas le joueur de football américain dont le nom est souvent mal orthographié dans le même champ de recherche, ni le meuble qui s’écrit de la même façon. Le modèle d’IA est toujours rattaché à Alibaba ou à « Tongyi Qianwen », son nom chinois.

Qui fabrique Qwen, et est-il chinois ?

Qwen est développé par Alibaba Cloud, la branche cloud du géant technologique chinois Alibaba, et sorti pour la première fois en 2023 sous le nom de Tongyi Qianwen. Oui, c’est un modèle chinois, qui fonctionne sous la loi chinoise. Cela concerne surtout l’app et l’API hébergées, qui envoient vos prompts aux serveurs d’Alibaba ; les modèles ouverts peuvent être auto-hébergés pour l’éviter.

Qwen est-il open source ?

En grande partie, avec une exception importante. La plupart des modèles Qwen sont publiés en poids ouverts sous la licence permissive Apache 2.0, ce qui vous permet de les télécharger, les exécuter et les affiner librement. Mais la génération 3.7 est restée propriétaire et accessible uniquement via l’API, du milieu de gamme Qwen3.7-Plus au Qwen3.7-Max, et la lignée Apache 2.0, qui allait jusqu’à Qwen3.6, a repris en août 2026 avec Qwen3.8-27B. Le 12 août 2026, Alibaba a publié les poids de Qwen3.8-Max, son premier modèle Max ouvert, mais l’exception reste réelle : la variante ouverte est texte seul et sa licence est une licence maison « Qwen3.8-Max », pas l’Apache 2.0 du reste de la famille. À la question « Qwen est-il open source ? », c’est donc oui pour les modèles que la plupart des gens utilisent, avec des conditions particulières pour le tout dernier flagship. Comme toujours, « poids ouverts » n’est pas non plus tout à fait « open source », puisque les données d’entraînement ne sont pas publiées.

Qwen est-il fiable pour un usage professionnel ?

Tout dépend de votre usage et de vos règles d’achat. L’app et l’API hébergées acheminent vos prompts vers des serveurs sous juridiction chinoise, un vrai enjeu pour le travail sensible ; l’auto-hébergement des poids ouverts garde vos données en interne. Par ailleurs, beaucoup d’entreprises interdisent par principe les modèles d’origine chinoise, quel que soit leur mode d’exécution : c’est souvent cette règle, plus que la technique, qui constitue le principal obstacle (la Direction générale du Trésor a débranché un pilote Qwen mi-2026 sur ce motif).

Qwen est-il gratuit, et combien coûte-t-il ?

Le chatbot Qwen et Qwen Studio sont gratuits, et les modèles ouverts se téléchargent et s’exécutent gratuitement sous leurs licences, si vous avez le matériel. Le modèle phare Qwen3.8-Max passe par une API payante, facturée 2 $ par million de tokens en entrée et 6 $ en sortie sur la région internationale d’Alibaba Cloud Model Studio en août 2026, avec une remise sur le cache de contexte et un million de tokens offerts pour démarrer ; pour un acheteur français, la TVA (20 %) s’ajoute à ce tarif en dollars. Le Qwen3.7-Max précédent affiche un tarif catalogue plus élevé, à 2,50 $ et 7,50 $, mais Alibaba y maintient une remise « à durée limitée » de 50 % quasi permanente, si bien que l’ancien modèle phare peut revenir moins cher que l’actuel. Vérifiez le prix en vigueur plutôt que de caler votre budget sur l’un ou l’autre chiffre. Même au catalogue, tout cela reste une fraction de ce que facturent des modèles occidentaux fermés comparables.

Dois-je suivre ou optimiser pour Qwen au nom de ma marque ?

Pas directement. Qwen est une infrastructure, pas un produit de recherche grand public : il n’y a rien à « optimiser ». Vous suivez les outils que vos acheteurs utilisent vraiment (ChatGPT, Perplexity, Gemini et Claude) et vous gardez votre marque accessible et cohérente sur tout le Web, pour que n’importe quel moteur, y compris les nombreux outils en aval qui tournent sur des modèles ouverts comme Qwen, puisse vous décrire correctement, avec des informations à jour.

Sources

  • Qwen - Wikipédia (famille de modèles, lignée, licences, scission Max propriétaire) - fr.wikipedia.org/wiki/Qwen
  • Qwen d’Alibaba dépasse les 3 milliards de téléchargements, devant Meta et Google - Bloomberg / Fortune, août 2026 - fortune.com/2026/08/15/alibaba-qwen-open-ai-models-3-billion-downloads-meta-google
  • Qwen3.7: The Agent Frontier (fiche de benchmarks officielle) - Alibaba Cloud - alibabacloud.com/blog/qwen3-7-the-agent-frontier_603154
  • Tarifs des modèles Model Studio (officiels) - Alibaba Cloud - alibabacloud.com/help/en/model-studio/model-pricing
  • Classement Terminal-Bench v2.1 (mesure indépendante de Qwen3.8-Max) - Artificial Analysis - artificialanalysis.ai/evaluations/terminalbench-v2-1
  • API et tarifs de Qwen3.8-Max - OpenRouter - openrouter.ai/qwen/qwen3.8-max
  • Qwen3.8-Max: A New Bar for Coding and Cowork (billet de lancement officiel, specifications et engagement sur les poids ouverts) - Qwen / Alibaba, 3 août 2026 - qwen.ai/blog?id=qwen3.8
  • Bercy débranche un pilote Qwen et bascule vers Mistral - Génération-NT, juin 2026 - generation-nt.com
  • Modèles Qwen - Hugging Face (poids ouverts) - huggingface.co/Qwen
  • Contrat de licence Tongyi Qianwen - QwenLM (clause des 100 millions d’utilisateurs actifs mensuels) - github.com/QwenLM/Qwen/blob/main/Tongyi%20Qianwen%20LICENSE%20AGREEMENT

Recevez nos analyses GEO IA par e-mail

Un e-mail quand nous publions quelque chose qui vaut la lecture.

À lire ensuite