Les tarifs de Qwen se divisent en deux voies très différentes, et la plupart des gens n’ont besoin que de la gratuite. L’application Qwen Chat est entièrement gratuite, sans abonnement, tandis que les développeurs paient au token via l’API, où les tarifs vont de 0,05 $ par million de tokens en entrée sur le modèle le moins cher jusqu’à 6,00 $ par million de tokens en sortie sur le modèle phare Qwen3.8-Max. Cet écart de 120x entre le tarif le moins cher et celui du modèle phare est la chose la plus importante à comprendre avant de choisir un modèle.

Ce guide détaille chaque volet des tarifs de Qwen pour 2026 : l’application gratuite Qwen Chat, les tarifs de l’API à l’usage pour chaque modèle, les paliers de taille d’entrée qui font grimper discrètement certains prix, l’essai gratuit de tokens pour les nouveaux développeurs, et comment Qwen se compare à DeepSeek et Claude côté coût. Nous abordons aussi le changement qui a pris de court bon nombre de développeurs, la fin du palier gratuit de l’API le 15 avril 2026, et les cas où Qwen reste le meilleur rapport qualité-prix.

Les points clés à retenir

  • Qwen Chat est gratuit, sans abonnement grand public comme ChatGPT Plus ou Claude Pro.
  • Les tarifs de l’API vont de 0,05 $ / 0,40 $ par million de tokens (Qwen-Flash) à 2,00 $ / 6,00 $ sur le modèle phare Qwen3.8-Max, disponible pour tous depuis le 3 août 2026. L’ancien modèle phare Qwen3.7-Max reste moins cher à 1,25 $ / 3,75 $ avec une promo de 50 % (prix catalogue 2,50 $ / 7,50 $).
  • Le modèle intermédiaire Qwen-Plus démarre à 0,40 $ / 1,20 $ par million de tokens, le meilleur équilibre entre prix et capacités pour la plupart des applications.
  • Plusieurs modèles Qwen sont facturés par paliers selon la taille d’entrée, si bien que le chiffre affiché est un prix « à partir de » qui grimpe sur les prompts longs (Qwen3-Max va de 1,20 $ à 3,00 $ en entrée sur ses 262K de contexte). Qwen3.8-Max fait exception et facture un tarif unique sur toute sa fenêtre de 1M.
  • Le palier gratuit de l’API pour développeurs a pris fin le 15 avril 2026, remplacé par un essai unique de 1 million de tokens par modèle (environ 70 millions au total) pour les nouveaux comptes.

Les tarifs de Qwen en un coup d’œil

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

Qwen est la famille de modèles d’IA d’Alibaba, et vous pouvez l’utiliser de deux façons. L’application grand public Qwen Chat sur chat.qwen.ai est gratuite, et l’API pour développeurs est facturée au token via Alibaba Cloud Model Studio (la plateforme anciennement appelée DashScope). Il n’existe aucun forfait mensuel grand public entre les deux, ce qui rend Qwen atypique face à ses rivaux occidentaux. Les modèles de base open source de Qwen alimentent aussi des variantes affinées par des tiers, dont Rio 3.5 Open 397B de la municipalité de Rio de Janeiro.

Voici le coût des principaux modèles de texte sur l’API, tarifés par million de tokens. L’entrée correspond à ce que vous payez pour le texte que vous envoyez, et la sortie à ce que vous payez pour le texte que le modèle génère en retour.

ModèleEntrée ($/1M)Sortie ($/1M)Fenêtre de contexteIdéal pour
Qwen-Flashà partir de 0,05 $à partir de 0,40 $1M tokensTâches simples à fort volume
Qwen-Plusà partir de 0,40 $à partir de 1,20 $1M tokensLe cheval de bataille au quotidien
Qwen3.7-Plusà partir de 0,32 $à partir de 1,28 $1M tokensApplications multimodales
Qwen3-Maxà partir de 1,20 $à partir de 6,00 $262K tokensRaisonnement complexe, code
Qwen3.7-Max1,25 $3,75 $1M tokensAncien modèle phare, le moins cher en promo
Qwen3.8-Max2,00 $6,00 $1M tokensModèle phare, tarif unique quelle que soit la longueur

Qwen3.8-Max a pris la place de modèle phare le 3 août 2026 à un tarif unique de 2,00 $ / 6,00 $. Son prédécesseur Qwen3.7-Max reste sur la grille tarifaire à 1,25 $ / 3,75 $, une remise promotionnelle de 50 % sur un prix catalogue de 2,50 $ / 7,50 $. Lisez ces deux lignes ensemble, car l’ancien modèle est le moins cher des deux tant que sa promo dure, et le plus cher une fois qu’elle prend fin. Alibaba n’a pas annoncé de date de fin pour cette remise, alors basez votre budget sur les prix catalogue pour tout ce qui est à long terme.

Une chose à savoir pour lire ces chiffres : Model Studio facture plusieurs tarifs par paliers selon la taille d’entrée de chaque requête, si bien que les chiffres « à partir de » ci-dessus sont les tarifs du palier d’entrée et que votre coût augmente sur les prompts plus longs. Vérifiez toujours le tarif en vigueur pour votre modèle et votre région dans la documentation tarifaire d’Alibaba Cloud Model Studio avant d’établir un budget.

Qwen est-il gratuit ?

Oui. L’application Qwen Chat sur chat.qwen.ai est gratuite, sans abonnement, tout comme la version gratuite de ChatGPT ou de Gemini. Vous accédez aux modèles performants de Qwen pour le chat au quotidien, la rédaction, l’aide au code et les tâches d’image sans rien payer, et Alibaba a de bonnes raisons commerciales de garder son application grand public gratuite.

La tarification payante n’entre en jeu que lorsque vous développez sur l’API Qwen via Alibaba Cloud Model Studio, qui facture au token. Donc si vous voulez simplement discuter avec Qwen, vous ne payez rien. Si vous voulez intégrer Qwen à votre propre produit, vous payez à l’usage.

Tarifs de l’API Qwen par modèle

Ci-dessous, nous avons détaillé les tarifs de l’API pour chacun des modèles de Qwen afin que vous puissiez associer le bon palier à votre charge de travail et à votre budget.

Qwen-Flash et Qwen-Turbo : à partir de 0,05 $ / 0,40 $

Qwen-Flash est le palier économique à partir de 0,05 $ en entrée / 0,40 $ en sortie par million de tokens pour les prompts jusqu’à 256K, montant à 0,25 $ / 2,00 $ sur les entrées plus longues. Il est conçu pour la vitesse et le volume, donc il convient à la classification, aux questions-réponses simples, au balisage, et à toute tâche où vous envoyez beaucoup de requêtes sans avoir besoin d’un raisonnement de niveau modèle phare. Qwen-Flash remplace désormais l’ancien Qwen-Turbo, qu’Alibaba a signalé comme n’étant plus mis à jour, si bien que les nouveaux projets devraient partir sur Flash par défaut. À ces tarifs, vous pouvez traiter des millions de tokens pour quelques dollars.

Qwen-Plus : à partir de 0,40 $ / 1,20 $

Qwen-Plus se situe au milieu à partir de 0,40 $ en entrée / 1,20 $ en sortie par million de tokens et c’est le modèle par lequel la plupart des applications devraient commencer. Il est facturé par paliers selon la longueur du prompt, si bien que le tarif grimpe vers 1,20 $ en entrée / 3,60 $ en sortie dès qu’une seule requête dépasse 256K tokens, et le mode de réflexion augmente encore la sortie. Il gère l’essentiel du travail réel, la synthèse, la rédaction, l’assistance au code et les tâches de récupération, à un prix qui reste raisonnable à grande échelle.

Qwen3.7-Plus : à partir de 0,32 $ / 1,28 $

Qwen3.7-Plus est le palier intermédiaire multimodal de Qwen, acceptant le texte, l’image et la vidéo en entrée. Il tourne à partir de 0,32 $ en entrée / 1,28 $ en sortie par million de tokens, une remise de 20 % sur le prix catalogue de 0,40 $ / 1,60 $, et comme Qwen-Plus, il est facturé par paliers croissants sur les longs contextes. Si vous créez des applications qui mêlent images ou vidéos et texte tout en restant économiques, c’est le palier à tester avant de passer à un modèle Max.

Qwen3-Max : à partir de 1,20 $ / 6,00 $

Qwen3-Max est le cheval de bataille du raisonnement lourd, tarifé à partir de 1,20 $ en entrée / 6,00 $ en sortie par million de tokens sur les prompts jusqu’à 32K. Le coût grimpe par tranches, 2,40 $ / 12 $ de 32K à 128K et 3,00 $ / 15 $ jusqu’à sa limite, si bien que les tâches à long contexte coûtent nettement plus que ne le laisse penser le tarif affiché. Notez que Qwen3-Max plafonne à 262K tokens de contexte, pas le million complet qu’atteignent les plus petits modèles Qwen.

Qwen3.8-Max : 2,00 $ / 6,00 $ (modèle phare)

Qwen3.8-Max est devenu disponible pour tous le 3 août 2026 et se place en haut de gamme : un modèle Mixture-of-Experts de 2,4 billions de paramètres qui en active environ 95 milliards par token. Il accepte le texte, l’image et la vidéo en entrée, renvoie jusqu’à 128K tokens en sortie, et coûte 2,00 $ en entrée / 6,00 $ en sortie par million de tokens. Contrairement à tous les autres modèles de cette page, ce tarif est unique sur l’ensemble du contexte de 1M tokens. Que vous envoyiez 5 000 tokens ou 900 000, le prix par token ne bouge pas, ce qui supprime l’effet de seuil lié à la taille d’entrée qui rend les factures de Qwen3-Max et de Qwen-Plus difficiles à prévoir.

C’est dans la mise en cache que se trouvent les économies. Les lectures d’entrée en cache implicite coûtent 0,25 $ par million, les lectures en cache explicite tombent à 0,17 $, et l’écriture dans un cache explicite coûte 2,50 $. À ces tarifs, un nouveau passage sur un document volumineux revient à environ un huitième du premier passage, ce qui est tout l’intérêt d’associer une fenêtre de 1M tokens à une tarification de cache agressive. Les tâches par lots sont facturées à demi-tarif. Pour les benchmarks et le vrai positionnement des poids ouverts, consultez notre analyse complète de Qwen 3.8.

Les nouveaux comptes obtiennent le modèle phare gratuitement pendant un temps. Model Studio indique un quota gratuit de 1 million de tokens valable 90 jours sur Qwen3.8-Max, la même allocation par modèle qui a remplacé l’ancien palier gratuit permanent de Qwen, de sorte que vous pouvez le tester sur votre propre charge de travail avant de payer quoi que ce soit. Une note sur les sources : les tableaux de facturation internationale détaillés d’Alibaba mettent encore Qwen3.7-Max en tête des modèles Max, donc si vous rapprochez une facture, vérifiez le tarif pour votre région et votre point de terminaison précis plutôt que de supposer 2 $ / 6 $ partout.

Qwen3.7-Max : 1,25 $ / 3,75 $ (ancien modèle phare)

Qwen3.7-Max a détenu la place de modèle phare jusqu’en août 2026 et reste le choix économique pour le raisonnement complexe, les mathématiques et le génie logiciel tant que sa remise dure. Il tourne à 1,25 $ en entrée / 3,75 $ en sortie par million de tokens grâce à une promotion de lancement de 50 %, soit la moitié du prix catalogue de 2,50 $ / 7,50 $, avec une fenêtre de contexte complète de 1M tokens. La remise est limitée dans le temps, alors prévoyez le prix catalogue si vous établissez un budget sur plusieurs mois. Qwen3.7-Max a obtenu 56,6 à l’Artificial Analysis Intelligence Index et 80,4 à SWE-Verified, ce qui le place dans le top 10 mondial au lancement. Pour l’analyse complète des benchmarks, consultez notre test de Qwen3.7-Max.

Le changement de palier gratuit que les développeurs doivent connaître

Qwen proposait autrefois un palier gratuit permanent pour l’API, et cela a pris fin le 15 avril 2026. Le palier OAuth gratuit pour développeurs et l’accès gratuit à Qwen Code CLI ont tous deux été supprimés à la même date, si bien que les anciens tutoriels qui promettent un « accès gratuit à l’API Qwen » sont désormais dépassés.

Ce qui l’a remplacé, c’est un essai d’intégration unique. Les nouveaux comptes Alibaba Cloud Model Studio reçoivent 1 million de tokens gratuits par modèle sur environ 70 modèles Qwen propriétaires, soit environ 70 millions de tokens au total, valables 90 jours et uniquement sur le point de terminaison de Singapour. C’est généreux pour le prototypage, mais c’est un essai, pas un forfait gratuit permanent, alors prévoyez votre budget pour quand il sera épuisé.

Comment réduire votre facture Qwen

Deux fonctionnalités intégrées abaissent les coûts réels bien en dessous des tarifs affichés. L’API de traitement par lots asynchrone traite les tâches non urgentes à environ 50 % de réduction sur les tarifs standard, ce qui est idéal pour la synthèse en masse, l’étiquetage de données ou le traitement nocturne quand vous n’avez pas besoin d’une réponse instantanée.

La mise en cache des prompts est le second levier. Lorsque vous réutilisez le même long prompt ou contexte système sur de nombreuses requêtes, les lectures d’entrée en cache ne coûtent qu’une petite fraction du tarif d’entrée normal, dans certains cas environ 10 % de celui-ci. Pour les chatbots et les agents qui répètent un long prompt système à chaque appel, c’est la différence entre une facture gérable et une facture coûteuse.

Qwen face à DeepSeek, ChatGPT et Claude côté coût

L’atout de Qwen, c’est le rapport prix-performance, et il concurrence directement d’autres modèles bon marché. Face à DeepSeek, une autre famille chinoise à poids ouverts connue pour ses tarifs agressifs, Qwen-Plus et Qwen-Flash se situent dans la même tranche économique, si bien que le choix dépend du modèle qui performe le mieux sur vos tâches précises. Un autre modèle chinois à poids ouverts à surveiller est Nex-N2-Pro, qui s’appuie sur l’architecture 397B de Qwen et vise le code agentique. Il en va de même pour GLM 5.2, le modèle à poids ouverts d’un million de tokens qui domine désormais les benchmarks de code ouverts ; notre guide des tarifs de GLM montre comment ses tarifs se comparent à ceux de Qwen. Tous se situent bien en dessous des tarifs des modèles phares américains.

ModèleEntrée ($/1M)Sortie ($/1M)ContexteIdéal pour
Qwen-Plusà partir de 0,40 $à partir de 1,20 $1MCheval de bataille économique au quotidien
Qwen3.7-Max1,25 $3,75 $1MAncien modèle phare, en promo
Qwen3.8-Max2,00 $6,00 $1MModèle phare actuel de Qwen
DeepSeek V40,435 $0,87 $1MLe rival économique le plus proche
Claude Opus 4.85,00 $25,00 $200KRéférence des modèles phares américains

Comparé à ChatGPT et Claude, Qwen est nettement moins cher au niveau de l’API. Claude Opus 4.8 est affiché à 5 $ / 25 $ par million de tokens, si bien que même le modèle phare Qwen3.8-Max revient à moins d’un quart du coût de sortie, et Qwen-Plus donne de solides résultats pour quelques centimes. DeepSeek V4 casse les prix de tout le marché à 0,435 $ / 0,87 $. Si le coût brut par token est votre critère déterminant, Qwen et DeepSeek l’emportent ; si vous avez besoin du tout haut des classements de benchmarks ou de fonctionnalités d’écosystème précises, le tableau est plus serré. Vous pouvez voir où se situent les labos américains dans notre comparatif de Claude face à GPT, consulter les promos en cours dans notre guide des essais gratuits d’IA, ou le comparer avec notre guide des tarifs de Mistral AI. Si vous voulez Qwen aux côtés d’autres modèles au même endroit, des agrégateurs comme OpenRouter revendent aussi Qwen à l’usage.

Une alternative plus simple à la facturation au token

La facturation au token de l’API est puissante, mais c’est excessif si vous voulez simplement utiliser les meilleurs modèles d’IA au quotidien. Suivre les tarifs d’entrée et de sortie de chaque modèle, surveiller les paliers de taille d’entrée qui font gonfler votre facture, voir votre essai gratuit expirer et gérer des factures distinctes pour chaque fournisseur, tout cela ajoute une friction dont la plupart des gens se passeraient.

C’est là que Fello AI entre en jeu. Pour un tarif fixe de 9,99 $ par mois, vous accédez à de nombreux modèles de premier plan dans une seule application Mac, dont Claude, ChatGPT, Gemini, Grok et DeepSeek, sans calcul au token ni jonglage entre plusieurs abonnements. Au lieu de mesurer chaque requête, vous choisissez le meilleur modèle pour la tâche et vous en changez librement. Si vous voulez une IA de niveau modèle phare sans facturation d’API, cette formule à prix unique et multi-modèles est bien plus simple ; vous pouvez comparer la sélection dans notre panorama des meilleurs modèles d’IA, et découvrir d’autres options économiques dans notre guide des tarifs de MiniMax.

Conclusion

Pour la plupart des gens, Qwen est de fait gratuit : l’application Qwen Chat ne coûte rien et couvre l’usage au quotidien. Pour les développeurs, Qwen est l’une des meilleures API en termes de rapport qualité-prix, de 0,05 $ par million de tokens sur Qwen-Flash jusqu’à un modèle phare qui reste bien en dessous des rivaux américains. Souvenez-vous seulement que le palier gratuit de l’API a disparu depuis avril 2026, que plusieurs tarifs sont facturés par paliers selon la longueur du prompt, et que la remise sur Qwen3.7-Max est temporaire, alors basez votre budget sur les prix catalogue et appuyez-vous sur le traitement par lots et la mise en cache des prompts pour maîtriser les coûts. Si vous préférez éviter complètement la facturation au token, une application multi-modèles à tarif fixe comme Fello AI vous offre une valeur du niveau de Qwen aux côtés de Claude, ChatGPT et Gemini pour un seul prix mensuel.

FAQ

Combien coûte Qwen ?

L’application Qwen Chat est gratuite. Sur l’API, les prix vont de 0,05 $ en entrée / 0,40 $ en sortie par million de tokens pour Qwen-Flash jusqu’à 2,00 $ / 6,00 $ pour le modèle phare Qwen3.8-Max, qui applique un tarif unique sur tout son contexte de 1M depuis qu’il est devenu disponible pour tous le 3 août 2026. L’ancien modèle phare Qwen3.7-Max est encore listé à 1,25 $ / 3,75 $ avec une promo de 50 % (prix catalogue 2,50 $ / 7,50 $), et le populaire modèle intermédiaire Qwen-Plus démarre à 0,40 $ / 1,20 $.

Qwen est-il gratuit ?

Oui, l’application grand public Qwen Chat sur chat.qwen.ai est gratuite, sans abonnement. Vous ne payez que si vous utilisez l’API Qwen via Alibaba Cloud Model Studio, qui facture au token.

Pourquoi ma facture d’API Qwen a-t-elle bondi sur un prompt long ?

Plusieurs modèles Qwen sont facturés par paliers selon la taille d’entrée, si bien que le tarif par token augmente à mesure que votre prompt grossit. Qwen3-Max, par exemple, passe de 1,20 $ / 6,00 $ à 3,00 $ / 15,00 $ sur sa plus grande tranche d’entrée, et le mode de réflexion augmente aussi le coût de sortie. Les prix affichés sont les tarifs du palier d’entrée. Qwen3.8-Max fait exception et facture un tarif unique de 2,00 $ / 6,00 $ quelle que soit la longueur du prompt.

Existe-t-il encore un palier gratuit pour l’API Qwen ?

Pas en tant que forfait permanent. Le palier gratuit de l’API pour développeurs a pris fin le 15 avril 2026. Les nouveaux comptes reçoivent à la place un essai unique de 1 million de tokens par modèle, environ 70 millions au total, valable 90 jours sur le point de terminaison de Singapour.

Qwen est-il moins cher que ChatGPT ?

Au niveau de l’API, oui, nettement. Qwen-Plus et Qwen-Flash coûtent une fraction de ce que facturent au token les modèles phares américains premium, ce qui explique pourquoi Qwen et DeepSeek sont des choix populaires pour les projets sensibles aux coûts.