Qwen est la famille de modèles IA d'Alibaba : la plus grande collection open source au monde, et un chat gratuit sans abonnement (Qwen Studio). Modèles 2026 : Qwen3.5 (ouvert) et Qwen3.7/3.8-Max (fermés, API). Multimodal, 201 langues. Revers : censure chinoise et données sur Alibaba Cloud. En local, aucun de ces problèmes.
L'IA gratuite d'Alibaba qui rivalise avec ChatGPT et Claude, et l'éléphant chinois dans la pièce que personne n'ose aborder.
Pendant que les concurrents vendent des abonnements, Alibaba laisse son chat en accès libre : tu ouvres Qwen Studio (ex-Qwen Chat, renommé en 2026), tu poses ta question, les modèles récents te répondent. Pas de plan « Plus », pas d'abonnement.
Qwen (prononcé « tchwen », de 通义千问, « Mille Questions ») est la plus grande famille de modèles IA open source au monde : 300 millions de téléchargements, plus de 100 000 modèles dérivés. L'année 2026 a toutefois marqué un tournant : Qwen3.5 (février) reste ouvert et téléchargeable, mais les fleurons Qwen3.7 (mai) et Qwen3.8-Max (3 août 2026, 2 400 milliards de paramètres) sont fermés, accessibles uniquement par API. Alibaba garde désormais le meilleur pour lui.
Mais il y a un sujet que les articles enthousiastes évitent soigneusement. Pose une question sur Taïwan, le Tibet ou Tiananmen. Les réponses deviennent évasives, formatées, alignées sur le discours officiel chinois. Et tes données transitent par des serveurs Alibaba Cloud, hors juridiction européenne. La parade existe : les modèles ouverts tournent en local, chez toi.
Qui est derrière Qwen ?
Qwen est la famille de modèles IA développée par l'équipe Qwen d'Alibaba, le géant chinois du e-commerce et du cloud. Partie d'un modèle 7B open source en 2023, elle est devenue la plus grande collection de modèles ouverts au monde, dépassant Meta Llama, avec 300 millions de téléchargements et plus de 100 000 modèles dérivés. Alibaba opère sous la régulation chinoise et héberge les données de la version en ligne sur ses serveurs Alibaba Cloud.
Depuis 2026, la stratégie a changé : l'open source sert de produit d'appel (générations 3.5 et antérieures), pendant que les modèles frontier (3.7, 3.8-Max) restent fermés et payants via l'API. Le pari : concurrencer OpenAI et Anthropic sur les prix, et Meta sur l'écosystème ouvert.
Août 2023
Alibaba publie Qwen-7B en open source, premier modèle de la famille.
2024
Génération Qwen2 : la famille s'élargit (texte, vision, audio, code) et s'impose sur Hugging Face.
Janvier 2025
Qwen2.5-Max, le modèle propriétaire qui place Alibaba dans la course aux frontier models.
Avril 2025
Génération Qwen3 en open-weight, du modèle 4B pour laptop au MoE 235B.
16 février 2026
Qwen3.5 : MoE 397B (17B actifs), multimodal natif (texte, image, vidéo), 201 langues. Disponible en open-weight et en version hébergée.
20 mai 2026
Série Qwen3.7 annoncée au Alibaba Cloud Summit : 3.7-Max (texte, raisonnement) et 3.7-Plus (agent multimodal). Fermés, API uniquement.
3 août 2026
Qwen3.8-Max en disponibilité générale : 2 400 milliards de paramètres, positionné face à Claude et GPT, à 2 $/M tokens en entrée et 6 $ en sortie.
Pour qui ?
✓ Idéal pour
Devs et curieux qui veulent du gratuit puissant, ou de l'open source à faire tourner en local.
✕ À éviter si
Tes données sont sensibles (serveurs en Chine) ou ton sujet touche à la géopolitique (censure).
Fonctionnalités clés 8
Qwen Studio (ex-Qwen Chat) : le chat gratuit
Renommée Qwen Studio en 2026, l'interface (web, desktop, mobile) donne accès gratuitement aux modèles récents d'Alibaba, sans abonnement. Tu discutes, tu uploades des documents de 50+ pages, tu analyses des images, tu génères du code, avec recherche web intégrée. Contexte de 128 000 tokens : de quoi digérer un rapport complet en une conversation. Données hébergées sur Alibaba Cloud : garde ça en tête pour tout contenu sensible.
Multimodal complet
Texte, images, vidéo, audio, code : tout dans un seul écosystème. Depuis Qwen3.5 (février 2026), la multimodalité est native : le modèle comprend texte, image et vidéo comme un tout unifié, dans 201 langues et dialectes. Un seul prompt peut référencer un document uploadé, une capture d'écran et du contexte textuel. Les générations précédentes (Qwen3-Omni) traitaient déjà de longues entrées audio et vidéo.
Open source (Apache 2.0), mais plus pour tout
Qwen publie ses modèles en poids ouverts sous licence Apache 2.0 : tu peux les télécharger, les inspecter, les modifier et les déployer sur ta propre infrastructure. C'est l'avantage décisif face aux boîtes noires américaines. Nuance 2026 : seules les générations 3.5 et antérieures sont ouvertes. Les fleurons Qwen3.7 et 3.8-Max sont fermés, accessibles uniquement par l'API d'Alibaba Cloud. L'open source reste massif, mais ce n'est plus le meilleur de la maison.
Tourne en local — même sur un laptop
Qwen3-4B (4 milliards de paramètres) fonctionne sur un ordinateur portable avec 4 Go de RAM. La qualité est comparable à des modèles qui nécessitaient une baie de serveurs il y a 2 ans. Pour les entreprises qui ne peuvent pas envoyer de données sur des serveurs externes (finance, santé, secteur public), c'est un argument massif. Tes données ne quittent jamais ton périmètre.
Famille de modèles spécialisés
Qwen n'est pas un seul modèle — c'est une famille complète :
Qwen3.5-397B — le flagship. 397 milliards de paramètres, dont seulement 17 milliards actifs par inférence (architecture MoE). Performances de pointe en raisonnement, code et compréhension multimodale.
Qwen3-Coder-Next — spécialisé coding. Conçu pour les agents de code, il excelle en raisonnement long, utilisation d'outils et récupération après erreurs d'exécution. 70%+ sur SWE-Bench Verified.
Qwen-VL — vision. Analyse d'images et de vidéos.
Qwen-Audio — audio. Reconnaissance vocale et synthèse dans 113 langues.
Qwen-Math — mathématiques et raisonnement logique.
API 60% moins chère que ChatGPT
Pour les développeurs, l'API via Alibaba Cloud Model Studio propose des tarifs significativement inférieurs aux concurrents américains. Tarification par tokens avec paliers — le coût dépend du modèle utilisé et de la longueur des échanges. Des modèles gratuits sont disponibles pour le prototypage.
119 langues supportées
Français, anglais, chinois évidemment, mais aussi arabe, espagnol, allemand, japonais et des dizaines d'autres. La qualité en français est solide pour la rédaction, l'analyse et le code. Le chinois-anglais est le point fort historique — excellent pour les entreprises qui travaillent sur les marchés asiatiques.
Les modèles 2026 : de Qwen3.5 à Qwen3.8-Max
L'échelle actuelle : Qwen3.5 (ouvert, MoE 397B dont 17B actifs) pour te servir en local ou en hébergé ; Qwen3.7-Plus (fermé) pour les agents multimodaux ; Qwen3.7-Max puis Qwen3.8-Max (3 août 2026, 2 400 milliards de paramètres) pour rivaliser avec Claude et GPT sur le raisonnement. Côté API, la grille va de Qwen-Turbo (0,05 $/M tokens en entrée) à 3.8-Max (2 $/M en entrée, 6 $/M en sortie) : parmi les moins chères du marché à niveau comparable.
Les limites, la partie honnête 6
La censure chinoise est réelle et documentée
Sur les sujets géopolitiques sensibles (Taïwan, Tibet, Tiananmen, Ouïghours, Hong Kong), les réponses de Qwen sont évasives, formatées ou alignées sur le discours officiel chinois. Ce n'est pas un bug — c'est une contrainte structurelle. Alibaba opère sous la régulation chinoise. Pour de la rédaction marketing, du code ou de l'analyse de données, ça ne pose aucun problème. Pour des recherches en sciences humaines, du journalisme ou du contenu politique, c'est un deal-breaker.
Tes données transitent par des serveurs Alibaba Cloud
La juridiction applicable n'est pas celle de l'Europe. Les standards de chiffrement sont industriels, mais le cadre juridique est fondamentalement différent du RGPD. Conseil de prudence : ne télécharge pas de documents confidentiels, données financières non publiques ou secrets industriels sur Qwen Chat. Ce principe s'applique d'ailleurs à toute IA publique — mais la dimension juridictionnelle chinoise ajoute une couche de vigilance.
La solution : le déploiement local
Si la confidentialité est critique, télécharge le modèle et fais-le tourner en local. Tes données ne quittent jamais ta machine. C'est l'avantage décisif de l'open source — et c'est impossible avec ChatGPT ou Claude.
La tarification API est complexe et imprévisible
Paliers par longueur de prompt, tarifs différents pour tokens d'entrée et de sortie, surcoûts pour le mode raisonnement, prix variables selon le modèle. Le coût est bas, mais le prévoir à l'avance est difficile sans monitoring précis.
L'écosystème et le support sont orientés Chine
La documentation est d'abord en chinois puis traduite. Le support d'Alibaba Cloud est principalement anglais/chinois. La communauté francophone est quasi inexistante. Si tu as un problème, tu cherches la solution en anglais sur GitHub — pas sur un forum FR.
La qualité en français est bonne mais pas exceptionnelle
Qwen excelle en chinois et en anglais. Le français est bien supporté pour les tâches courantes (rédaction, analyse, code), mais sur des nuances stylistiques fines ou du contenu éditorial haut de gamme, Claude reste supérieur. Pour 95% des besoins, c'est largement suffisant.
Conformité & souveraineté
Hébergement des donnéesAu choix
RGPDProblématique
AI ActLimité
Entraînement sur tes donnéesInconnu
Interface en françaisOui
Tes données transitent par des serveurs Alibaba Cloud (hors UE). La juridiction applicable n'est pas celle de l'Europe. Les standards de chiffrement sont industriels, mais le cadre juridique est fondamentalement différent du RGPD. Conseil de prudence : ne télécharge pas de documents confidentiels, données financières non publiques ou secrets industriels sur Qwen Chat. Pour des données sensibles, utilise le déploiement local — c'est exactement pour ça que le modèle est open source.
Tarifs 3 paliers
Qwen Studio (web, desktop, mobile)
Gratuit
Gratuit, sans abonnement. Modèles récents, multimodal, recherche web, contexte 128K. Données sur serveurs Alibaba Cloud.
API (Alibaba Cloud)
Sur devis
Pay-as-you-go : de Qwen-Turbo (0,05 $/M tokens en entrée) à Qwen3.8-Max (2 $/M in, 6 $/M out). Le free tier a été supprimé le 15 avril 2026, remplacé par 1M tokens in + 1M out offerts pendant 90 jours (endpoint Singapour).
Local (open source)
Gratuit
Gratuit, illimité. Générations ouvertes (3.5 et antérieures) sous Apache 2.0, via Ollama ou Hugging Face. Données 100 % chez toi.
Le verdict
Mon avis honnête : le vrai argument de Qwen en 2026 n'est plus « gratuit contre payant » (ChatGPT a rendu le texte illimité en gratuit, tout le monde a un bon plan gratuit). C'est l'open source en local : aucun autre acteur de ce niveau ne te laisse télécharger un modèle sérieux, le faire tourner via Ollama sur ta machine, et garder 100 % de tes données chez toi. C'est comme ça que je conseille d'utiliser Qwen, et c'est imbattable.
La version en ligne (Qwen Studio), elle, est un bon chat gratuit, mais je ne l'utilise pas pour du travail client : données sur Alibaba Cloud, censure documentée sur les sujets chinois, et depuis que les fleurons 3.7/3.8 sont fermés, tu n'y gagnes même plus l'accès au meilleur modèle de la maison. Pour le quotidien, Claude, ChatGPT ou Mistral restent devant.
Dernière mise à jour : août 2026.
FAQ Qwen 8
Qwen est-il gratuit ?
Oui. Qwen Studio (ex-Qwen Chat) est gratuit sans abonnement, sur le web, desktop et mobile. Les modèles open source (Apache 2.0) sont téléchargeables et gratuits en local. Seule l'API est payante, avec 1M tokens d'entrée et 1M de sortie offerts pendant 90 jours.
Qwen fonctionne-t-il en français ?
Oui. Le français fait partie des 119 langues supportées. La qualité est solide pour la rédaction, l'analyse de documents et le code. Pour du contenu éditorial haut de gamme, Claude reste supérieur en nuances stylistiques.
Qwen ou ChatGPT ?
Qwen si tu veux du gratuit sans compte, ou de l'open source à faire tourner en local. ChatGPT pour l'écosystème le plus mature et l'expérience la plus polie. Sur le raisonnement, Qwen3.8-Max se mesure aux frontier models américains, mais la différence se joue sur l'UX, la censure et la confiance dans les données.
Peut-on faire tourner Qwen en local ?
Oui. C'est l'un des avantages décisifs. Qwen3-4B fonctionne sur un laptop avec 4 Go de RAM. Les modèles plus gros (72B, 397B) nécessitent du hardware plus puissant. Via Ollama, l'installation se fait en quelques minutes. Tes données ne quittent jamais ta machine.
Qwen est-il censuré ?
Sur les sujets géopolitiques sensibles liés à la Chine (Taïwan, Tibet, Ouïghours), oui — les réponses sont formatées ou évasives. Sur tout le reste (marketing, code, analyse de données, rédaction), aucune censure perceptible. C'est une contrainte structurelle liée à la régulation chinoise, pas un choix technique.
Mes données sont-elles en sécurité sur Qwen Chat ?
Les données transitent par des serveurs Alibaba Cloud (hors UE). Le chiffrement est industriel mais la juridiction n'est pas européenne. Pour des données sensibles, utilise le déploiement local — c'est exactement pour ça que le modèle est open source.
Qwen a-t-il un abonnement payant ?
Non. Contrairement à ChatGPT Plus ou Claude Pro, il n'existe pas d'abonnement grand public : Qwen Studio est entièrement gratuit. Les seuls coûts concernent l'API (pay-as-you-go pour les développeurs) ou le matériel si tu fais tourner les modèles en local.
C'est quoi Qwen3.8-Max ?
Le modèle le plus puissant d'Alibaba, en disponibilité générale depuis le 3 août 2026 : 2 400 milliards de paramètres, positionné face à Claude et GPT. Il est fermé (API uniquement, 2 $/M tokens en entrée, 6 $/M en sortie), contrairement aux générations ouvertes comme Qwen3.5.