Os preços do DeepSeek em 2026 dividem-se em quatro níveis: um chat gratuito em chat.deepseek.com, a API principal DeepSeek V4 Flash a $0,22/$0,66 por milhão de tokens fora de pico, DeepSeek V4 Pro a $0,66/$1,98 por milhão de tokens fora de pico, e uma oferta gratuita de API de 5 milhões de tokens para cada nova conta de programador. Todos os modelos V4 incluem uma janela de contexto nativa de 1 milhão de tokens sem custo adicional, o que coloca o V4 Flash 36 vezes mais barato na entrada e 107 vezes mais barato na saída do que um modelo de topo como o GPT-5.6 Sol ou o Claude Opus 5. Comparado com os níveis mais económicos, a diferença é muito menor, e desde o corte de preços da OpenAI em julho a vantagem é de 1,4x na entrada.

Este guia cobre todos os aspetos dos preços do DeepSeek em 2026: as novas tarifas da API V4 Flash e V4 Pro, os custos do chat V3 e do raciocínio R1, o plano gratuito e a alteração de preços de pico que o DeepSeek anunciou mas ainda não agendou. Abordamos também os preços no OpenRouter e no AWS Bedrock, bem como a comparação do DeepSeek com o ChatGPT, o Claude e o Gemini. Se procura uma única subscrição que inclua o DeepSeek e os outros modelos de topo, também tratamos disso no final. A nossa comparação completa DeepSeek vs Claude coloca os dois lado a lado.

Os Pontos Principais

  • O DeepSeek V4 Flash custa $0,22/M na entrada fora de pico e $0,44/M em pico (cache miss), com saída a $0,66 e $1,32, numa janela de contexto de 1M tokens.
  • Os preços subiram a 16 de agosto de 2026. O V4 Pro custa agora $0,66/M na entrada fora de pico e $1,32/M em pico, com saída a $1,98 e $3,96. O desconto permanente de 75% acabou.
  • O chat web do DeepSeek é gratuito para utilizadores individuais, sem plano Plus nem Pro.
  • A API do DeepSeek oferece 5 milhões de tokens gratuitos a cada nova conta.
  • Os cache hits custam uma fração dos cache misses, pelo que o cache de prompts pode reduzir as faturas em 80% ou mais.
  • O antigo desconto de 50 a 75% fora do horário de pico foi removido. O DeepSeek substituiu-o a 16 de agosto de 2026 por preços 2x no horário de pico.

O que são os preços do DeepSeek?

Do editor

Todos os modelos de IA numa só aplicação

Fello AI reúne GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 e mais numa só aplicação nativa para Mac e iPhone.

Descarregue já!

Os preços do DeepSeek funcionam por pagamento por token: é cobrado por milhão de tokens de texto que o modelo lê (entrada) e escreve (saída). Não existem subscrições mensais na API nem taxas por utilizador. Desde as 16:00 UTC de 16 de agosto de 2026, a tarifa depende também da hora a que faz a chamada. As horas de pico são das 01:00 às 04:00 e das 06:00 às 10:00 UTC, de segunda a sexta, e todas as outras horas são fora de pico, a exatamente metade da tarifa. As tarifas atuais começam em $0,22 por milhão de tokens de entrada fora de pico no DeepSeek V4 Flash.

O DeepSeek posiciona-se deliberadamente abaixo de todos os laboratórios ocidentais. O seu rival mais próximo em preço é o Qwen da Alibaba, analisado no nosso guia de preços do Qwen. Como referimos na nossa análise do lançamento do DeepSeek V4, o objetivo declarado da empresa é manter preços mínimos, suportados por chips Huawei Ascend e Cambricon. Isso mantém os preços do DeepSeek muito abaixo dos níveis de topo da OpenAI e da Anthropic, embora os níveis mais económicos destas tenham aproximado a diferença nos tokens de entrada.

Preços do DeepSeek 2026 (chat gratuito, V4 Flash e V4 Pro com tarifas de pico e fora de pico)

Os preços do DeepSeek em 2026 cobrem quatro níveis: um chat web gratuito, dois modelos de API (V4 Flash e V4 Pro), e uma oferta gratuita de 5 milhões de tokens para novas contas de programador. Todos os valores abaixo provêm da página oficial de preços do DeepSeek e estão em USD por 1.000.000 de tokens.

PlanoPreçoModelosContexto / limitesIdeal para
Chat web gratuito$0V4 Flash (sem raciocínio + com raciocínio)Limitação de utilização justa em horário de picoUtilizadores individuais no chat.deepseek.com ou na aplicação móvel
API V4 Flash$0,22 / $0,44 entrada / $0,66 / $1,32 saída por M tokens, fora de pico / picodeepseek-v4-flash (versão 0731)Contexto 1M, saída máxima 384KAPI polivalente económica
API V4 Pro$0,66 / $1,32 entrada / $1,98 / $3,96 saída por M tokens, fora de pico / picodeepseek-v4-proContexto 1M, saída máxima 384KRaciocínio de fronteira a uma fração do custo dos rivais
Oferta gratuita de API$0 por 5M tokens / 30 diasTodos os modelos DeepSeekLimites de taxa normais, sem cartão de créditoNovas contas de programador a avaliar a API

Chat web do DeepSeek a $0 (gratuito para utilizadores individuais)

O chat web do DeepSeek em chat.deepseek.com e a aplicação móvel oficial são completamente gratuitos para utilizadores individuais. Não há plano Plus, nem nível Pro, nem barreira de pagamento para envio de ficheiros ou conversas longas. A única limitação é a regulação de utilização justa: em horário de pico, podem surgir avisos de «Servidor Ocupado». As sessões de chat gratuito correm por predefinição no V4 Flash e permitem ativar o DeepThink para mudar para o modo de raciocínio do V4 Flash.

Preços do DeepSeek V4 Flash

O DeepSeek V4 Flash é o modelo de API económico por omissão. Custa $0,22 por milhão de tokens de entrada fora de pico com cache miss e $0,44 em pico, com saída a $0,66 e $1,32. Os cache hits descem para $0,007 e $0,014 por milhão. O V4 Flash suporta modo com e sem raciocínio sob o ID deepseek-v4-flash e traz uma janela de contexto de 1 milhão de tokens e até 384K tokens de saída. É o modelo a usar por omissão para tudo o que não exija raciocínio profundo.

Desde 31 de julho de 2026, esse ID serve o DeepSeek-V4-Flash-0731, a versão oficial que substituiu a pré-visualização de abril. A Artificial Analysis elevou o V4 Flash de 40 para 50 na versão do Intelligence Index que usava na altura. O preço, esse, mudou. A tarifa fixa de $0,14 / $0,28 com que este modelo foi lançado foi retirada a 16 de agosto de 2026, pelo que qualquer valor de custo por tarefa calculado antes dessa data já não se aplica.

Preços do DeepSeek V4 Pro

O DeepSeek V4 Pro é o modelo de raciocínio principal. Custa $0,66 por milhão de tokens de entrada fora de pico com cache miss e $1,32 em pico, com cache hits a $0,022 e $0,044, e saída a $1,98 e $3,96. O V4 Pro partilha a mesma janela de 1M e os 384K de saída máxima do V4 Flash, e o ID do modelo é deepseek-v4-pro. Continua muito mais barato do que qualquer modelo principal ocidental, mas o desconto de 75% que o DeepSeek chegou a chamar permanente terminou em agosto de 2026.

Oferta gratuita de API do DeepSeek a $0 (5 milhões de tokens por 30 dias)

Cada nova conta de programador do DeepSeek começa com uma oferta de 5 milhões de tokens válida por 30 dias, sem cartão de crédito obrigatório. É suficiente para cerca de 2.500 a 5.000 chamadas de teste consoante o comprimento dos prompts, com um valor de cerca de $8,40 às tarifas atuais do V4 Flash. Após esgotar a oferta, a faturação passa para as tarifas normais de pagamento por token acima indicadas, podendo recarregar o saldo com um pequeno depósito.

Detalhe por milhão de tokens do DeepSeek (cache miss vs cache hit)

ModeloEntrada (cache miss), fora de pico / picoEntrada (cache hit), fora de pico / picoSaída, fora de pico / picoContextoNotas
deepseek-v4-flash$0,22 / $0,44$0,007 / $0,014$0,66 / $1,321MModelo económico predefinido, serve a versão 0731
deepseek-v4-pro$0,66 / $1,32$0,022 / $0,044$1,98 / $3,961MModelo de raciocínio principal
Preços de lançamento da era V3 (deepseek-chat)$0,27$0,07$1,1064KHistórico. ID retirado a 24 de julho de 2026
Preços de lançamento da era R1 (deepseek-reasoner)$0,55$0,14$2,1964KHistórico. ID retirado a 24 de julho de 2026

Os IDs de modelo anteriores ao V4, deepseek-chat e deepseek-reasoner, foram descontinuados. Foram retirados após 24 de julho de 2026, às 15:59 UTC, e a documentação do DeepSeek lista agora exatamente dois IDs de modelo: deepseek-v4-flash e deepseek-v4-pro. Se ainda tiver essas strings num ficheiro de configuração, as chamadas falharão. As tarifas V3 e R1 abaixo são mantidas apenas para referência histórica.

Preços do V4 Flash vs V4 Pro

O DeepSeek V4 Flash é o modelo económico e rápido para uso geral. O V4 Pro é o modelo de raciocínio profundo com um número muito maior de parâmetros ativos. O V4 Pro custa cerca de 3 vezes mais por token do que o Flash, pelo que se deve usar o Flash por predefinição e recorrer ao Pro apenas quando uma tarefa exige realmente profundidade de raciocínio. Mesmo a 3x, o V4 Pro é o modelo de raciocínio de fronteira mais económico do mercado.

Como funcionam os preços do DeepSeek?

Os preços do DeepSeek têm três camadas, com poupança em cada uma delas.

  1. Tokens. Cada pedido é medido em tokens de entrada (o que se envia) e tokens de saída (o que o modelo gera). Um milhão de tokens corresponde a cerca de 750.000 palavras em inglês.
  2. Cache hits. Se parte do seu prompt tiver sido processada recentemente, o DeepSeek serve-a a partir do cache com um desconto significativo (cerca de 98% de desconto face à tarifa de cache miss no V4 Flash). Os prompts de sistema e o contexto partilhado beneficiam mais.
  3. Sobretaxa em horário de pico, em vigor. O desconto fora de pico do V3 e R1 foi retirado juntamente com esses endpoints. O DeepSeek substituiu-o a 16 de agosto de 2026 por preços de pico e fora de pico, em que o horário de pico custa 2x a tarifa fora de pico, aplicada a todos os itens de faturação. O pico é definido como 9:00 às 12:00 e 14:00 às 18:00, hora de Pequim, ou seja, das 01:00 às 04:00 e das 06:00 às 10:00 UTC, de segunda a sexta. Faça o orçamento com a tarifa de pico para tudo o que corra nessas janelas.

Paga apenas o que utiliza. Não existe gasto mínimo, taxa mensal nem custo pelo comprimento da janela de contexto em si.

O DeepSeek é gratuito? Plano gratuito e chat web

Sim, o DeepSeek tem opções gratuitas. A experiência de chat para consumidores em chat.deepseek.com e na aplicação móvel oficial é completamente gratuita para utilizadores individuais. Não há plano Plus, nem nível Pro, nem barreira de pagamento para envio de ficheiros ou conversas longas. A única limitação é a regulação de utilização justa: em horário de pico, podem surgir avisos de «Servidor Ocupado».

Para programadores, a API inclui uma oferta de 5 milhões de tokens para novos registos, válida por 30 dias. É suficiente para 2.500 a 5.000 chamadas de teste consoante o comprimento dos prompts, com um valor de cerca de $8,40 às tarifas atuais do V4 Flash. Não é necessário cartão de crédito, e após esgotar a oferta a faturação passa para as tarifas normais de pagamento por token indicadas acima.

Preços do DeepSeek no OpenRouter, AWS Bedrock e Azure

Se não quiser utilizar a API própria do DeepSeek, vários fornecedores terceiros alojam os mesmos modelos. Os preços variam porque cada plataforma acrescenta a sua margem, custo de infraestrutura e encaminhamento.

FornecedorModeloEntrada/MSaída/MNotas
OpenRouterDeepSeek V4 ProvariavariaRota de terceiros, com preços independentes das tarifas de pico e fora de pico do DeepSeek
OpenRouterDeepSeek V4 FlashvariavariaRota de terceiros, com preços independentes das tarifas de pico e fora de pico do DeepSeek
OpenRouterDeepSeek V3.2$0,252$0,378Opção legacy de nível intermédio
OpenRouterDeepSeek R1 (raciocínio)$0,70$2,50Modelo original R1 com cadeia de raciocínio
AWS BedrockDeepSeek V3.2$0,62$1,85Mais caro que o direto, mas adequado para empresas
Azure AI FoundryDeepSeek (vários)variávelvariávelOs preços dependem da região e do SKU

O OpenRouter também oferece vários modelos destilados do DeepSeek gratuitos, incluindo os destilados R1 mais pequenos e o DeepSeek V3 Base, com limites de taxa mas sem custos de tokens. São ótimos para prototipagem.

Preços do DeepSeek R1 vs V3

Esta é uma das perguntas mais frequentes sobre os preços do DeepSeek. A resposta curta: o R1 raciocina melhor mas custa cerca de 5 vezes mais por consulta. Quando for lançado, iremos mapear os preços do DeepSeek R2 assim que as tarifas oficiais forem publicadas.

ModeloEntrada/M, fora de pico / picoSaída/M, fora de pico / picoIdeal para
DeepSeek V3 (legacy deepseek-chat)$0,27$1,10Chat geral, resumos, escrita
DeepSeek R1 (legacy deepseek-reasoner)$0,55$2,19Matemática, lógica, raciocínio multi-etapa
DeepSeek V4 Flash$0,22 / $0,44$0,66 / $1,32Substitui o V3, mais económico e com maior contexto
DeepSeek V4 Pro$0,66 / $1,32$1,98 / $3,96Substitui o R1, raciocínio de fronteira

O R1 gera muito mais tokens de saída por pedido porque produz uma cadeia de raciocínio antes da resposta final. Isso alarga a diferença de preço na prática. Com o V4, tanto o Flash como o Pro suportam modos com e sem raciocínio, pelo que é possível escolher a profundidade de raciocínio em cada chamada. Para mais informações sobre o raciocínio original, consulte a nossa análise completa do DeepSeek-R1 e como superou a OpenAI.

Como os preços do DeepSeek se comparam ao GPT-5.6, Claude e Gemini

ModeloEntrada/M, fora de pico / picoSaída/M, fora de pico / picoMultiplicador face ao DeepSeek V4 Flash (fora de pico)
DeepSeek V4 Flash$0,22 / $0,44$0,66 / $1,321x
DeepSeek V4 Pro$0,66 / $1,32$1,98 / $3,963x / 3x
GPT-5.6 Luna$0,20$1,200,9x / 1,8x
GPT-5.6 Terra$2,00$12,009,1x / 18,2x
Gemini 3.1 Pro$2,00 (abaixo de 200K de contexto)$12,009,1x / 18,2x
Claude Sonnet 5$2,00*$10,00*9,1x / 15,2x
GPT-5.6 Sol$4,00$20,0018,2x / 30,3x
Claude Opus 5$5,00$25,0022,7x / 37,9x

* O Claude Sonnet 5 está a $2/$10 numa tarifa introdutória. Devia passar para $3/$15 a 1 de setembro de 2026, mas a Anthropic cancelou a subida a 10 de agosto de 2026. Note como a classificação depende muito do nível: os modelos de fronteira continuam 36x mais caros na entrada, mas o corte da OpenAI em julho de 2026 baixou o Luna para $0,20, o que aproxima suficientemente os preços para que o custo por token já não seja o único argumento.

O DeepSeek não é sempre o modelo mais inteligente numa tabela de avaliação, mas em preço por token útil nada se aproxima. Para cargas de trabalho de grande volume como pipelines de conteúdo, resumo, classificação e RAG sobre grandes corpora, o DeepSeek é frequentemente o único modelo que torna a economia unitária viável. Para a comparação completa incluindo os níveis de subscrição mensal, consulte a nossa comparação completa de preços de IA. Para uma análise frente a frente em capacidades, precisão e onde cada modelo vence, leia a nossa comparação DeepSeek vs ChatGPT.

Como otimizar os custos da API do DeepSeek

Algumas medidas simples podem reduzir uma fatura do DeepSeek em 50 a 90 por cento.

  1. Fixe o seu prompt de sistema. Os cache hits são 98% mais baratos no V4 Flash. Mantenha o mesmo contexto inicial em todos os pedidos.
  2. Use o V4 Flash por predefinição. Recorra ao V4 Pro apenas quando a tarefa exige realmente profundidade de raciocínio.
  3. Limite a sua saída. Paga por token de saída, por isso defina max_tokens para o valor mais baixo que ainda funcione.
  4. Mantenha as tarefas em lote fora do horário comercial de Pequim. As janelas mais caras são das 9:00 às 12:00 e das 14:00 às 18:00, hora de Pequim (UTC+8), ou seja, das 01:00 às 04:00 e das 06:00 às 10:00 UTC, de segunda a sexta. Agendar tarefas pesadas fora dessas janelas reduz a fatura para metade, e assim é desde 16 de agosto de 2026.
  5. Use o contexto de 1M do V4 com critério. Uma janela de contexto longa não tem custo extra no modelo de preços do DeepSeek, pelo que pode incluir mais resultados de recuperação em vez de pagar por rondas repetidas.
  6. Experimente primeiro os destilados gratuitos do OpenRouter. Prototipe com os destilados R1 gratuitos e depois altere o ID do modelo quando estiver pronto para lançar.

Quer o DeepSeek sem se preocupar com chaves de API? Experimente o Fello AI

A maioria dos leitores não quer mesmo escrever código para uma API. O que querem é conversar com o melhor modelo para a tarefa sem gerir cinco subscrições, cinco separadores e cinco contextos de memória diferentes.

O Fello AI é a forma mais simples de fazer exatamente isso. Uma subscrição dá acesso ao DeepSeek, ChatGPT, Claude, Gemini, Grok, Perplexity e a vários outros modelos de topo numa única aplicação para Mac, iPhone e iPad por $9.99 por mês. Não há faturação por token a acompanhar, nem limite de utilização a gerir, nem conta separada para cada fornecedor. Tudo fica numa única janela de chat e num único histórico.

Por que razão o Fello AI funciona bem para utilizadores do DeepSeek

O DeepSeek continua a ser um dos modelos mais económicos na API, mas o chat web oficial tem limitações e a experiência no computador é básica. O Fello AI resolve ambos. Tem o DeepSeek dentro de uma verdadeira aplicação nativa para Mac com histórico de prompts, envio de ficheiros, análise de imagens, entrada por voz e a possibilidade de mudar de modelo a meio da conversa quando o DeepSeek não é a melhor ferramenta para a próxima mensagem. Se o seu prompt ficaria melhor com a escrita do Claude ou o raciocínio do GPT, mude de modelo sem perder o contexto.

O que poupa na prática

Some o custo padrão de subscrição dos principais modelos: ChatGPT Plus a $20/mês, Claude Pro a $20/mês, Gemini Advanced a $20/mês, Perplexity Pro a $20/mês e Grok a $30/mês. Isso corresponde a cerca de $110 por mês de acesso individual. O Fello AI reúne o mesmo conjunto por $9.99 por mês, com o DeepSeek incluído na subscrição. Com mais de 25.000 avaliações de cinco estrelas na App Store e Mac App Store, é a aplicação de IA em pacote mais apreciada no ecossistema Apple.

Se preferir manter o DeepSeek separado dos restantes, temos também um guia sobre um cliente desktop do DeepSeek para Mac.

Conclusão

Os preços do DeepSeek em 2026 continuam entre os mais baixos na fronteira, mas já não são uma tarifa única. O V4 Flash a $0,22/$0,66 fora de pico, ou $0,44/$1,32 em pico, continua a superar todos os laboratórios ocidentais no custo, e o V4 Pro a $0,66/$1,98 fora de pico mantém um modelo de raciocínio de topo abaixo de dois dólares por milhão de tokens de saída. O que mudou a 16 de agosto de 2026 é que a sua fatura passou a depender do relógio. O chat web continua gratuito, a API oferece 5 milhões de tokens e a cache de prompts corta ainda cerca de 97% no custo de entradas repetidas.

Se desenvolve software, vá diretamente à página oficial de preços do DeepSeek e comece com o V4 Flash. Se apenas quer usar o DeepSeek junto com o ChatGPT, o Claude e o Gemini num único lugar, o Fello AI é a opção mais simples.

FAQ

O DeepSeek é gratuito?

Sim para utilizadores individuais. O chat web em chat.deepseek.com e a aplicação móvel oficial são gratuitos, sem nível Plus nem Pro. A API também oferece a cada nova conta um crédito de 5 milhões de tokens antes de a faturação começar.

Quanto custa a API do DeepSeek por milhão de tokens?

O DeepSeek V4 Flash custa $0,22 por milhão de tokens de entrada fora de pico e $0,44 em pico com cache miss, com saída a $0,66 e $1,32. O V4 Pro fica em $0,66 a $1,32 na entrada e $1,98 a $3,96 na saída. As horas de pico são das 01:00 às 04:00 e das 06:00 às 10:00 UTC, de segunda a sexta.

Qual é a diferença de preços entre o V4 Flash e o V4 Pro?

O V4 Flash é o modelo económico a $0,22/$0,66 por milhão de tokens fora de pico. O V4 Pro é o modelo de raciocínio principal e custa exatamente 3 vezes mais, a $0,66/$1,98 fora de pico. Ambos duplicam em horas de pico.

Os preços do DeepSeek são mais baratos do que os do ChatGPT ou Claude?

Depende do escalão que comparar e da hora a que faz a chamada. Face a modelos principais como o GPT-5.6 Sol ($4/$20) ou o Claude Opus 5 ($5/$25), o V4 Flash é 18 a 23 vezes mais barato na entrada fora de pico, e metade disso em pico. Face ao escalão mais barato da OpenAI, o GPT-5.6 Luna a $0,20/$1,20, a diferença fechou-se: o Luna é agora ligeiramente mais barato na entrada e o V4 Flash é apenas cerca de 1,8 vezes mais barato na saída. O DeepSeek continua muito mais barato do que os modelos grandes, mas já não por uma ordem de grandeza.

Quais são os preços do DeepSeek no OpenRouter?

O OpenRouter replica as tarifas diretas do DeepSeek para o V4 Flash e V4 Pro, e adiciona vários modelos destilados gratuitos para prototipagem com limites de taxa mas sem custos de tokens.

O DeepSeek cobra extra pela janela de contexto de 1 milhão de tokens?

Não. O contexto completo de 1M está incluído na tarifa normal de tokens tanto no V4 Flash como no V4 Pro.