Os preços do Qwen dividem-se em dois percursos muito diferentes, e a maioria das pessoas só precisa do gratuito. A aplicação Qwen Chat é completamente gratuita, sem subscrição, enquanto os programadores pagam por token através da API, onde as tarifas vão de $0.05 por milhão de tokens de entrada no modelo mais barato até $6.00 por milhão de tokens de saída no modelo de topo, o Qwen3.8-Max. Essa diferença de 120x entre a tarifa mais barata e a do modelo de topo é a coisa mais importante a entender antes de escolher um modelo.
Este guia detalha todas as partes dos preços do Qwen em 2026, incluindo a aplicação gratuita Qwen Chat, as tarifas da API com pagamento por utilização para cada modelo, os níveis por tamanho de entrada que sobem discretamente alguns preços, o teste gratuito de tokens para novos programadores, e como o Qwen se compara ao DeepSeek e ao Claude em custo. Também abordamos a mudança que surpreendeu muitos programadores, o fim do nível gratuito da API a 15 de abril de 2026, e onde o Qwen continua a oferecer a melhor relação qualidade-preço.
Os pontos principais
- O Qwen Chat é gratuito, sem subscrição para consumidores como o ChatGPT Plus ou o Claude Pro.
- Os preços da API vão de $0.05 / $0.40 por milhão de tokens (Qwen-Flash) a $2.00 / $6.00 no modelo de topo Qwen3.8-Max, disponível para todos desde 3 de agosto de 2026. O antigo modelo de topo Qwen3.7-Max continua mais barato, a $1.25 / $3.75, com uma promoção de 50% (preço de tabela $2.50 / $7.50).
- O nível intermédio Qwen-Plus começa em $0.40 / $1.20 por milhão de tokens, o melhor equilíbrio entre preço e capacidade para a maioria das aplicações.
- Vários modelos Qwen são faturados por níveis de tamanho de entrada, pelo que o valor em destaque é um preço «desde» que sobe em prompts longos (o Qwen3-Max vai de $1.20 a $3.00 na entrada ao longo dos seus 262K de contexto). O Qwen3.8-Max é a exceção, cobrando uma tarifa fixa em toda a sua janela de 1M.
- O nível gratuito da API para programadores terminou a 15 de abril de 2026, substituído por um teste único de 1 milhão de tokens por modelo (cerca de 70 milhões no total) para novas contas.
Preços do Qwen de relance
O Qwen é a família de modelos de IA da Alibaba, e pode usá-lo de duas formas. A aplicação Qwen Chat para consumidores, em chat.qwen.ai, é gratuita, e a API para programadores é faturada por token através do Alibaba Cloud Model Studio (a plataforma anteriormente chamada DashScope). Não existe nenhum plano fixo mensal para consumidores a meio caminho, o que torna o Qwen pouco habitual face aos rivais ocidentais. Os modelos base abertos do Qwen também servem de base a ajustes finos de terceiros, incluindo o Rio 3.5 Open 397B, da câmara municipal do Rio de Janeiro.
Eis quanto custam os principais modelos de texto na API, com preços por milhão de tokens. A entrada é o que paga pelo texto que envia, e a saída é o que paga pelo texto que o modelo gera de volta. Se esta distinção lhe é nova, a nossa explicação sobre o que são os tokens de IA cobre o motivo pelo qual os dois têm preços diferentes.
| Modelo | Entrada ($/1M) | Saída ($/1M) | Janela de contexto | Mais indicado para |
|---|---|---|---|---|
| Qwen-Flash | desde $0.05 | desde $0.40 | 1M tokens | Tarefas simples de grande volume |
| Qwen-Plus | desde $0.40 | desde $1.20 | 1M tokens | O cavalo de batalha do dia a dia |
| Qwen3.7-Plus | desde $0.32 | desde $1.28 | 1M tokens | Aplicações multimodais |
| Qwen3-Max | desde $1.20 | desde $6.00 | 262K tokens | Raciocínio difícil, programação |
| Qwen3.7-Max | $1.25 | $3.75 | 1M tokens | Antigo modelo de topo, o mais barato em promoção |
| Qwen3.8-Max | $2.00 | $6.00 | 1M tokens | Modelo de topo, tarifa fixa a qualquer comprimento |
O Qwen3.8-Max assumiu o lugar de modelo de topo a 3 de agosto de 2026, com uma tarifa fixa de $2.00 / $6.00. O seu antecessor, o Qwen3.7-Max, mantém-se na tabela de preços a $1.25 / $3.75, um desconto promocional de 50% sobre um preço de tabela de $2.50 / $7.50. Leia estas duas linhas em conjunto, porque o modelo mais antigo é o mais barato dos dois enquanto a promoção durar, e o mais caro dos dois quando esta terminar. A Alibaba não publicou uma data de fim para esse desconto, por isso planeie o orçamento com base nos preços de tabela para qualquer coisa a longo prazo.
Uma coisa a saber ao ler estes números: o Model Studio escalona várias tarifas pelo tamanho de entrada de cada pedido, pelo que os valores «desde» acima são as tarifas do nível de entrada e o seu custo sobe em prompts mais longos. Confirme sempre a tarifa em vigor para o seu modelo e região na documentação de preços do Alibaba Cloud Model Studio antes de planear o orçamento.
O Qwen é gratuito?
Sim. A aplicação Qwen Chat, em chat.qwen.ai, é gratuita para utilizar e não exige subscrição, muito como o nível gratuito do ChatGPT ou do Gemini. Tem acesso aos modelos fortes do Qwen para conversas do dia a dia, escrita, ajuda com programação e tarefas de imagem, sem pagar nada, e a Alibaba tem razões comerciais claras para manter a aplicação para consumidores gratuita.
A faturação só começa quando constrói sobre a API do Qwen através do Alibaba Cloud Model Studio, que cobra por token. Portanto, se só quiser conversar com o Qwen, não paga nada. Se quiser integrar o Qwen no seu próprio produto, paga pela utilização.
Preços da API do Qwen por modelo
Abaixo detalhamos os preços da API para cada um dos modelos do Qwen, para que possa escolher o nível certo para a sua carga de trabalho e orçamento.
Qwen-Flash e Qwen-Turbo: desde $0.05 / $0.40
O Qwen-Flash é o nível económico, a partir de $0.05 de entrada / $0.40 de saída por milhão de tokens para prompts até 256K, subindo para $0.25 / $2.00 em entradas mais longas. Foi concebido para velocidade e grande volume, por isso serve para classificação, perguntas e respostas simples, etiquetagem, e qualquer tarefa em que envie muitos pedidos e não precise de raciocínio ao nível do modelo de topo. O Qwen-Flash substitui agora o antigo Qwen-Turbo, que a Alibaba assinalou como já não estando a receber atualizações, pelo que novos projetos devem optar por omissão pelo Flash. A estas tarifas, pode processar milhões de tokens por poucos dólares.
Qwen-Plus: desde $0.40 / $1.20
O Qwen-Plus fica no meio, a partir de $0.40 de entrada / $1.20 de saída por milhão de tokens, e é o modelo com que a maioria das aplicações deve começar. É escalonado pelo comprimento do prompt, pelo que a tarifa sobe para $1.20 de entrada / $3.60 de saída quando um único pedido ultrapassa os 256K tokens, e o modo de raciocínio aumenta ainda mais a saída. Trata o grosso do trabalho real, resumos, rascunhos, ajuda com programação e tarefas de recuperação, a um preço que se mantém razoável à escala.
Qwen3.7-Plus: desde $0.32 / $1.28
O Qwen3.7-Plus é o nível intermédio multimodal do Qwen, aceitando entrada de texto, imagem e vídeo. Funciona a partir de $0.32 de entrada / $1.28 de saída por milhão de tokens, um desconto de 20% sobre o preço de tabela de $0.40 / $1.60, e, como o Qwen-Plus, é escalonado para cima em contexto longo. Se está a construir aplicações que combinam imagens ou vídeo com texto e quer manter os custos baixos, este é o nível a testar antes de avançar para um modelo Max.
Qwen3-Max: desde $1.20 / $6.00
O Qwen3-Max é o cavalo de batalha do raciocínio pesado, com preços a partir de $1.20 de entrada / $6.00 de saída por milhão de tokens em prompts até 32K. O custo sobe em escalões, $2.40 / $12 dos 32K aos 128K e $3.00 / $15 até ao seu limite, por isso tarefas de contexto longo custam visivelmente mais do que a tarifa em destaque sugere. Note que o Qwen3-Max tem um limite de 262K tokens de contexto, não o 1M completo que os modelos Qwen mais pequenos alcançam.
Qwen3.8-Max: $2.00 / $6.00 (modelo de topo)
O Qwen3.8-Max tornou-se disponível para todos a 3 de agosto de 2026 e situa-se no topo da gama, um modelo Mixture-of-Experts de 2,4 biliões de parâmetros que ativa cerca de 95 mil milhões de parâmetros por token. Aceita entrada de texto, imagem e vídeo, devolve até 128K tokens de saída, e custa $2.00 de entrada / $6.00 de saída por milhão de tokens. Ao contrário de qualquer outro modelo nesta página, essa tarifa é fixa em toda a janela de contexto de 1M tokens. Envie 5.000 tokens ou 900.000 e o preço por token não muda, o que elimina o salto por tamanho de entrada que torna as contas do Qwen3-Max e do Qwen-Plus difíceis de prever.
É na cache que está a poupança. As leituras de entrada em cache implícita custam $0.25 por milhão, as leituras em cache explícita baixam para $0.17, e escrever numa cache explícita custa $2.50. A estas tarifas, uma segunda passagem sobre um documento grande custa cerca de um oitavo da primeira passagem, que é precisamente o objetivo de combinar uma janela de 1M tokens com preços de cache agressivos. As tarefas em lote são faturadas a metade da tarifa. Para os benchmarks e para saber onde os pesos abertos realmente se situam, veja a nossa análise completa do Qwen 3.8.
As novas contas têm o modelo de topo gratuito por um tempo. O Model Studio lista uma quota gratuita de 1 milhão de tokens válida durante 90 dias no Qwen3.8-Max, a mesma dotação por modelo que substituiu o antigo nível gratuito permanente do Qwen, para que possa testá-lo com a sua própria carga de trabalho antes de pagar o que quer que seja. Uma nota sobre a fonte: as tabelas de faturação internacional detalhadas da Alibaba continuam a destacar o Qwen3.7-Max como o principal modelo Max, por isso, se estiver a reconciliar uma fatura, confirme a tarifa para a sua região e endpoint específicos, em vez de assumir $2 / $6 em todo o lado.
Qwen3.7-Max: $1.25 / $3.75 (antigo modelo de topo)
O Qwen3.7-Max ocupou o lugar de modelo de topo até agosto de 2026 e continua a ser a melhor escolha de valor para raciocínio difícil, matemática e trabalho de engenharia de software enquanto o seu desconto durar. Custa $1.25 de entrada / $3.75 de saída por milhão de tokens, numa promoção de lançamento de 50%, metade do preço de tabela de $2.50 / $7.50, com uma janela de contexto completa de 1M tokens. O desconto é limitado no tempo, por isso planeie com base no preço de tabela se estiver a orçamentar para meses à frente. O Qwen3.7-Max obteve 56,6 no Artificial Analysis Intelligence Index e 80,4 no SWE-Verified, ficando entre os 10 melhores do mundo no lançamento. Para a análise completa dos benchmarks, veja a nossa análise do Qwen3.7-Max.
A mudança no nível gratuito que os programadores precisam de conhecer
O Qwen costumava oferecer um nível gratuito permanente na API, que terminou a 15 de abril de 2026. O nível OAuth gratuito para programadores e o acesso gratuito à Qwen Code CLI foram ambos removidos na mesma data, por isso tutoriais mais antigos que prometem «acesso gratuito à API do Qwen» estão agora desatualizados.
O que o substituiu é um teste único de integração. As novas contas do Alibaba Cloud Model Studio recebem 1 milhão de tokens gratuitos por modelo em cerca de 70 modelos Qwen proprietários, ou seja, cerca de 70 milhões de tokens no total, válidos durante 90 dias e apenas no endpoint de Singapura. Isso é generoso para prototipagem, mas é um teste, não um plano gratuito permanente, por isso planeie o orçamento para quando este terminar.
Como reduzir a sua conta do Qwen
Duas funcionalidades incorporadas reduzem os custos reais bem abaixo das tarifas em destaque. A API em lote assíncrona processa tarefas não urgentes a cerca de 50% de desconto sobre as tarifas normais, o que é ideal para resumos em massa, etiquetagem de dados, ou processamento noturno em que não precisa de uma resposta instantânea.
A cache de prompts é a segunda alavanca. Quando reutiliza o mesmo prompt longo ou contexto de sistema em muitos pedidos, as leituras de entrada em cache custam apenas uma pequena fração da tarifa normal de entrada, em alguns casos cerca de 10% dessa tarifa. Para chatbots e agentes que repetem um grande prompt de sistema em cada chamada, esta é a diferença entre uma conta sustentável e uma dispendiosa.
Qwen vs DeepSeek, ChatGPT e Claude em custo
O apelo do Qwen está na relação preço-desempenho, e compete diretamente com outros modelos de baixo custo. Face ao DeepSeek, outra família chinesa de pesos abertos conhecida pelos preços agressivos, o Qwen-Plus e o Qwen-Flash situam-se na mesma faixa de preço, pelo que a escolha se reduz a qual dos modelos tem melhor desempenho nas suas tarefas específicas. Outro modelo chinês de pesos abertos a ter em conta é o Nex-N2-Pro, que se baseia na própria arquitetura de 397B do Qwen e tem como alvo a programação agêntica. O mesmo se aplica ao GLM 5.2, o modelo de pesos abertos de 1 milhão de tokens que agora lidera os benchmarks de programação em código aberto; o nosso guia de preços do GLM mostra como as suas tarifas se comparam às do Qwen. Todos eles ficam muito abaixo dos preços dos modelos de topo dos EUA.
| Modelo | Entrada ($/1M) | Saída ($/1M) | Contexto | Mais indicado para |
|---|---|---|---|---|
| Qwen-Plus | desde $0.40 | desde $1.20 | 1M | Cavalo de batalha barato do dia a dia |
| Qwen3.7-Max | $1.25 | $3.75 | 1M | Antigo modelo de topo, em promoção |
| Qwen3.8-Max | $2.00 | $6.00 | 1M | Atual modelo de topo do Qwen |
| DeepSeek V4-Pro | $0.66 / $1.32 | $1.98 / $3.96 | 1M | Rival económico mais próximo |
| Claude Opus 4.8 | $5.00 | $25.00 | 200K | Referência de modelo de topo dos EUA |
Em comparação com o ChatGPT e o Claude, o Qwen é dramaticamente mais barato ao nível da API. O Claude Opus 4.8 está listado a $5 / $25 por milhão de tokens, pelo que mesmo o modelo de topo do Qwen, o Qwen3.8-Max, fica a menos de um quarto do custo de saída, e o Qwen-Plus entrega resultados fortes por tostões. O DeepSeek subiu as suas tarifas a 16 de agosto de 2026 e agora fatura por hora do dia: o V4-Pro custa $0.66 / $1.98 fora de pico e o dobro em pico (01:00-04:00 e 06:00-10:00 UTC, de segunda a sexta), por isso já não é mais barato do que o Qwen-Plus em nenhum dos dois eixos. O nível mais barato do DeepSeek, o V4.1-Flash, continua a ser, a $0.15 / $0.60 fora de pico após o corte de 10 de setembro de 2026. Se o custo bruto por token é o seu fator decisivo, o Qwen e o DeepSeek ganham; se precisa do topo absoluto das tabelas de benchmarks ou de funcionalidades específicas do ecossistema, o quadro é mais equilibrado. Pode ver onde se situam os laboratórios dos EUA na nossa análise sobre como o Claude e o GPT se comparam, e consultar as promoções atuais no nosso guia sobre testes gratuitos de IA, ou comparar com o nosso guia de preços do Mistral AI. Se quiser o Qwen junto com outros modelos num só lugar, agregadores como o OpenRouter também revendem o Qwen em regime de pagamento por utilização.
Uma alternativa mais simples à faturação por token
Os preços da API por token são poderosos, mas são excessivos se só quiser usar os melhores modelos de IA no dia a dia. Acompanhar tarifas de entrada e saída entre modelos, ver os níveis por tamanho de entrada a empurrar a conta para cima, ver o teste gratuito a expirar, e gerir contas separadas para cada fornecedor, acrescenta um atrito que a maioria das pessoas não quer.
É aqui que o Fello AI entra. Por $9.99 por mês, fixos, tem acesso a muitos dos principais modelos numa única aplicação Mac, incluindo Claude, ChatGPT, Gemini, Grok e DeepSeek, sem contas por token e sem ter de gerir várias subscrições. Em vez de medir cada pedido, escolhe o melhor modelo para a tarefa e muda livremente entre eles. O próprio Qwen está incluído nessa lista, como um cliente nativo do Qwen para Mac, sem necessidade de configurar nenhuma conta Model Studio. Se quiser IA de nível de topo sem faturação por API, essa configuração de um preço para muitos modelos é muito mais simples; pode comparar a lista completa no nosso resumo dos melhores modelos de IA, e ver outras opções económicas no nosso guia de preços do MiniMax.
Conclusão
Para a maioria das pessoas, o Qwen é, na prática, gratuito: a aplicação Qwen Chat não custa nada e cobre a utilização diária. Para programadores, o Qwen é uma das APIs com melhor relação qualidade-preço disponíveis, desde $0.05 por milhão de tokens no Qwen-Flash até a um modelo de topo que continua a ficar bem abaixo dos rivais dos EUA. Lembre-se apenas de que o nível gratuito da API desapareceu desde abril de 2026, várias tarifas são escalonadas pelo comprimento do prompt, e o desconto do Qwen3.7-Max é temporário, por isso construa o seu orçamento com base nos preços de tabela e aproveite o processamento em lote e a cache de prompts para manter os custos baixos. Se preferir evitar por completo a faturação por token, uma aplicação multimodelo de preço fixo como o Fello AI dá-lhe o valor do Qwen a par do Claude, do ChatGPT e do Gemini, por um preço mensal único.
FAQ
Quanto custa o Qwen?
A aplicação Qwen Chat é gratuita. Na API, os preços vão de $0.05 de entrada / $0.40 de saída por milhão de tokens no Qwen-Flash até $2.00 / $6.00 no modelo de topo Qwen3.8-Max, que cobra uma tarifa fixa em toda a sua janela de contexto de 1M desde que ficou disponível para todos a 3 de agosto de 2026. O antigo modelo de topo Qwen3.7-Max continua listado a $1.25 / $3.75 numa promoção de 50% (tabela $2.50 / $7.50), e o popular nível intermédio Qwen-Plus começa em $0.40 / $1.20.
O Qwen é gratuito de utilizar?
Sim, a aplicação Qwen Chat para consumidores, em chat.qwen.ai, é gratuita e sem subscrição. Só paga se usar a API do Qwen através do Alibaba Cloud Model Studio, que fatura por token.
Porque é que a minha conta da API do Qwen subiu com um prompt longo?
Vários modelos Qwen são escalonados pelo tamanho de entrada, pelo que a tarifa por token sobe conforme o prompt cresce. O Qwen3-Max, por exemplo, vai de $1.20 / $6.00 até $3.00 / $15.00 no seu maior escalão de entrada, e o modo de raciocínio também aumenta o custo de saída. Os preços em destaque são as tarifas do nível de entrada. O Qwen3.8-Max é a exceção, faturando uma única tarifa fixa de $2.00 / $6.00 a qualquer comprimento de prompt.
Ainda existe um nível gratuito da API do Qwen?
Não como plano permanente. O nível gratuito da API para programadores terminou a 15 de abril de 2026. Em vez disso, as novas contas recebem um teste único de 1 milhão de tokens por modelo, cerca de 70 milhões no total, válido durante 90 dias no endpoint de Singapura.
O Qwen é mais barato do que o ChatGPT?
Ao nível da API, sim, significativamente. O Qwen-Plus e o Qwen-Flash custam uma fração do que os modelos de topo premium dos EUA cobram por token, razão pela qual o Qwen e o DeepSeek são escolhas populares para projetos sensíveis ao custo.