Os preços do DeepSeek em 2026 dividem-se em quatro níveis: um chat gratuito em chat.deepseek.com, a API principal DeepSeek V4 Flash a $0,14/$0,28 por milhão de tokens, DeepSeek V4 Pro a $0,435/$0,87 por milhão de tokens, e uma oferta gratuita de API de 5 milhões de tokens para cada nova conta de programador. Todos os modelos V4 incluem uma janela de contexto nativa de 1 milhão de tokens sem custo adicional, o que coloca o V4 Flash 36 vezes mais barato na entrada e 107 vezes mais barato na saída do que um modelo de topo como o GPT-5.6 Sol ou o Claude Opus 5. Comparado com os níveis mais económicos, a diferença é muito menor, e desde o corte de preços da OpenAI em julho a vantagem é de 1,4x na entrada.

Este guia cobre todos os aspetos dos preços do DeepSeek em 2026: as novas tarifas da API V4 Flash e V4 Pro, os custos do chat V3 e do raciocínio R1, o plano gratuito e a alteração de preços de pico que o DeepSeek anunciou mas ainda não agendou. Abordamos também os preços no OpenRouter e no AWS Bedrock, bem como a comparação do DeepSeek com o ChatGPT, o Claude e o Gemini. Se procura uma única subscrição que inclua o DeepSeek e os outros modelos de topo, também tratamos disso no final.

Os Pontos Principais

  • O DeepSeek V4 Flash custa $0,14/M na entrada (cache miss) e $0,28/M na saída, com uma janela de contexto de 1M tokens. Esse ID serve agora a versão 0731, ao mesmo preço.
  • O DeepSeek V4 Pro custa $0,435/M na entrada e $0,87/M na saída, após um corte de preço permanente de 75%.
  • O chat web do DeepSeek é gratuito para utilizadores individuais, sem plano Plus nem Pro.
  • A API do DeepSeek oferece 5 milhões de tokens gratuitos a cada nova conta.
  • Os cache hits custam uma fração dos cache misses, pelo que o cache de prompts pode reduzir as faturas em 80% ou mais.
  • O antigo desconto de 50 a 75% fora do horário de pico foi removido. O DeepSeek anuncia que irá adotar preços 2x no horário de pico, sem data definida.

O que são os preços do DeepSeek?

Do editor

Todos os modelos de IA numa só aplicação

Fello AI reúne GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 e mais numa só aplicação nativa para Mac e iPhone.

Descarregue já!

Os preços do DeepSeek funcionam por pagamento por token: é cobrado por milhão de tokens de texto que o modelo lê (entrada) e escreve (saída). Não existem subscrições mensais na API nem taxas por utilizador. As tarifas atuais começam em $0,14 por milhão de tokens de entrada para o DeepSeek V4 Flash e sobem para alguns dólares por milhão no modelo de topo V4 Pro.

O DeepSeek posiciona-se deliberadamente abaixo de todos os laboratórios ocidentais. O seu rival mais próximo em preço é o Qwen da Alibaba, analisado no nosso guia de preços do Qwen. Como referimos na nossa análise do lançamento do DeepSeek V4, o objetivo declarado da empresa é manter preços mínimos, suportados por chips Huawei Ascend e Cambricon. Isso mantém os preços do DeepSeek muito abaixo dos níveis de topo da OpenAI e da Anthropic, embora os níveis mais económicos destas tenham aproximado a diferença nos tokens de entrada.

Preços do DeepSeek 2026 (chat gratuito, V4 Flash a $0,14/$0,28, V4 Pro a $0,435/$0,87)

Os preços do DeepSeek em 2026 cobrem quatro níveis: um chat web gratuito, dois modelos de API (V4 Flash e V4 Pro), e uma oferta gratuita de 5 milhões de tokens para novas contas de programador. Todos os valores abaixo provêm da página oficial de preços do DeepSeek e estão em USD por 1.000.000 de tokens.

PlanoPreçoModelosContexto / limitesIdeal para
Chat web gratuito$0V4 Flash (sem raciocínio + com raciocínio)Limitação de utilização justa em horário de picoUtilizadores individuais no chat.deepseek.com ou na aplicação móvel
API V4 Flash$0,14 entrada / $0,28 saída por M tokensdeepseek-v4-flash (versão 0731)Contexto 1M, saída máxima 384KAPI polivalente económica
API V4 Pro$0,435 entrada / $0,87 saída por M tokensdeepseek-v4-proContexto 1M, saída máxima 384KRaciocínio de fronteira a uma fração do custo dos rivais
Oferta gratuita de API$0 por 5M tokens / 30 diasTodos os modelos DeepSeekLimites de taxa normais, sem cartão de créditoNovas contas de programador a avaliar a API

Chat web do DeepSeek a $0 (gratuito para utilizadores individuais)

O chat web do DeepSeek em chat.deepseek.com e a aplicação móvel oficial são completamente gratuitos para utilizadores individuais. Não há plano Plus, nem nível Pro, nem barreira de pagamento para envio de ficheiros ou conversas longas. A única limitação é a regulação de utilização justa: em horário de pico, podem surgir avisos de «Servidor Ocupado». As sessões de chat gratuito correm por predefinição no V4 Flash e permitem ativar o DeepThink para mudar para o modo de raciocínio do V4 Flash.

DeepSeek V4 Flash a $0,14 / $0,28 por milhão de tokens

O DeepSeek V4 Flash é o modelo API económico predefinido. Custa $0,14 por milhão de tokens de entrada em cache miss e $0,28 por milhão de tokens de saída, com cache hits reduzidos a apenas $0,0028 por milhão (um desconto de 98%). O V4 Flash suporta modo sem raciocínio e com raciocínio sob o ID deepseek-v4-flash, e inclui uma janela de contexto de 1 milhão de tokens mais até 384K tokens de saída. É o modelo indicado por predefinição para tudo o que não exija raciocínio profundo.

Desde 31 de julho de 2026, esse ID serve o DeepSeek-V4-Flash-0731, a versão oficial que substituiu a pré-visualização de abril. O preço não se alterou, mas a capacidade sim: a Artificial Analysis elevou o V4 Flash de 40 para 50 no seu Índice de Inteligência, o que corresponde a $0,03 por tarefa de índice, o valor mais baixo registado nessa tabela. O Gemini 3.6 Flash obtém os mesmos 50 pontos e custa $0,56 por tarefa, cerca de 19 vezes mais. Uma ressalva a ter em conta: esta pontuação é de uma única tabela, tem poucos dias, e o V4 Flash ainda não tem votos em nenhuma tabela de preferências humanas.

DeepSeek V4 Pro a $0,435 / $0,87 por milhão de tokens

O DeepSeek V4 Pro é o modelo de raciocínio principal. Após um corte de preço de 75% que o DeepSeek tornou permanente, custa $0,435 por milhão de tokens de entrada (cache miss), $0,003625 por milhão em cache hits e $0,87 por milhão de tokens de saída. O V4 Pro partilha o mesmo contexto de 1M e saída máxima de 384K do V4 Flash, e o ID do modelo é deepseek-v4-pro. A estas tarifas, é o modelo de raciocínio de fronteira mais económico do mercado.

Oferta gratuita de API do DeepSeek a $0 (5 milhões de tokens por 30 dias)

Cada nova conta de programador do DeepSeek começa com uma oferta de 5 milhões de tokens válida por 30 dias, sem cartão de crédito obrigatório. É suficiente para cerca de 2.500 a 5.000 chamadas de teste consoante o comprimento dos prompts, com um valor de cerca de $8,40 às tarifas atuais do V4 Flash. Após esgotar a oferta, a faturação passa para as tarifas normais de pagamento por token acima indicadas, podendo recarregar o saldo com um pequeno depósito.

Detalhe por milhão de tokens do DeepSeek (cache miss vs cache hit)

ModeloEntrada (cache miss)Entrada (cache hit)SaídaContextoNotas
deepseek-v4-flash$0,14$0,0028$0,281MModelo económico predefinido, serve a versão 0731
deepseek-v4-pro$0,435$0,003625$0,871MModelo de raciocínio principal (corte permanente de 75%)
Preços de lançamento da era V3 (deepseek-chat)$0,27$0,07$1,1064KHistórico. ID retirado a 24 de julho de 2026
Preços de lançamento da era R1 (deepseek-reasoner)$0,55$0,14$2,1964KHistórico. ID retirado a 24 de julho de 2026

Os IDs de modelo anteriores ao V4, deepseek-chat e deepseek-reasoner, foram descontinuados. Foram retirados após 24 de julho de 2026, às 15:59 UTC, e a documentação do DeepSeek lista agora exatamente dois IDs de modelo: deepseek-v4-flash e deepseek-v4-pro. Se ainda tiver essas strings num ficheiro de configuração, as chamadas falharão. As tarifas V3 e R1 abaixo são mantidas apenas para referência histórica.

Preços do V4 Flash vs V4 Pro

O DeepSeek V4 Flash é o modelo económico e rápido para uso geral. O V4 Pro é o modelo de raciocínio profundo com um número muito maior de parâmetros ativos. O V4 Pro custa cerca de 3 vezes mais por token do que o Flash, pelo que se deve usar o Flash por predefinição e recorrer ao Pro apenas quando uma tarefa exige realmente profundidade de raciocínio. Mesmo a 3x, o V4 Pro é o modelo de raciocínio de fronteira mais económico do mercado.

Como funcionam os preços do DeepSeek?

Os preços do DeepSeek têm três camadas, com poupança em cada uma delas.

  1. Tokens. Cada pedido é medido em tokens de entrada (o que se envia) e tokens de saída (o que o modelo gera). Um milhão de tokens corresponde a cerca de 750.000 palavras em inglês.
  2. Cache hits. Se parte do seu prompt tiver sido processada recentemente, o DeepSeek serve-a a partir do cache com um desconto significativo (cerca de 98% de desconto face à tarifa de cache miss no V4 Flash). Os prompts de sistema e o contexto partilhado beneficiam mais.
  3. Sobretaxa em horário de pico, a chegar. O desconto fora de pico do V3 e R1 foi retirado juntamente com esses endpoints. A documentação do DeepSeek indica agora que irá adotar preços de pico e fora de pico, em que o horário de pico custa 2x a tarifa normal, aplicada a todos os itens de faturação, numa data ainda não anunciada. O pico é definido como 9:00 às 12:00 e 14:00 às 18:00, hora de Pequim. Nada mudou ainda na tabela de tarifas, por isso faça o orçamento com as tarifas normais e acompanhe a documentação.

Paga apenas o que utiliza. Não existe gasto mínimo, taxa mensal nem custo pelo comprimento da janela de contexto em si.

O DeepSeek é gratuito? Plano gratuito e chat web

Sim, o DeepSeek tem opções gratuitas. A experiência de chat para consumidores em chat.deepseek.com e na aplicação móvel oficial é completamente gratuita para utilizadores individuais. Não há plano Plus, nem nível Pro, nem barreira de pagamento para envio de ficheiros ou conversas longas. A única limitação é a regulação de utilização justa: em horário de pico, podem surgir avisos de «Servidor Ocupado».

Para programadores, a API inclui uma oferta de 5 milhões de tokens para novos registos, válida por 30 dias. É suficiente para 2.500 a 5.000 chamadas de teste consoante o comprimento dos prompts, com um valor de cerca de $8,40 às tarifas atuais do V4 Flash. Não é necessário cartão de crédito, e após esgotar a oferta a faturação passa para as tarifas normais de pagamento por token indicadas acima.

Preços do DeepSeek no OpenRouter, AWS Bedrock e Azure

Se não quiser utilizar a API própria do DeepSeek, vários fornecedores terceiros alojam os mesmos modelos. Os preços variam porque cada plataforma acrescenta a sua margem, custo de infraestrutura e encaminhamento.

FornecedorModeloEntrada/MSaída/MNotas
OpenRouterDeepSeek V4 Pro$0,435$0,87Igual aos preços diretos do DeepSeek
OpenRouterDeepSeek V4 Flash$0,14$0,28Igual à API direta
OpenRouterDeepSeek V3.2$0,252$0,378Opção legacy de nível intermédio
OpenRouterDeepSeek R1 (raciocínio)$0,70$2,50Modelo original R1 com cadeia de raciocínio
AWS BedrockDeepSeek V3.2$0,62$1,85Mais caro que o direto, mas adequado para empresas
Azure AI FoundryDeepSeek (vários)variávelvariávelOs preços dependem da região e do SKU

O OpenRouter também oferece vários modelos destilados do DeepSeek gratuitos, incluindo os destilados R1 mais pequenos e o DeepSeek V3 Base, com limites de taxa mas sem custos de tokens. São ótimos para prototipagem.

Preços do DeepSeek R1 vs V3

Esta é uma das perguntas mais frequentes sobre os preços do DeepSeek. A resposta curta: o R1 raciocina melhor mas custa cerca de 5 vezes mais por consulta. Quando for lançado, iremos mapear os preços do DeepSeek R2 assim que as tarifas oficiais forem publicadas.

ModeloEntrada/MSaída/MIdeal para
DeepSeek V3 (legacy deepseek-chat)$0,27$1,10Chat geral, resumos, escrita
DeepSeek R1 (legacy deepseek-reasoner)$0,55$2,19Matemática, lógica, raciocínio multi-etapa
DeepSeek V4 Flash$0,14$0,28Substitui o V3, mais económico e com maior contexto
DeepSeek V4 Pro$0,435$0,87Substitui o R1, raciocínio de fronteira

O R1 gera muito mais tokens de saída por pedido porque produz uma cadeia de raciocínio antes da resposta final. Isso alarga a diferença de preço na prática. Com o V4, tanto o Flash como o Pro suportam modos com e sem raciocínio, pelo que é possível escolher a profundidade de raciocínio em cada chamada. Para mais informações sobre o raciocínio original, consulte a nossa análise completa do DeepSeek-R1 e como superou a OpenAI.

Como os preços do DeepSeek se comparam ao GPT-5.6, Claude e Gemini

ModeloEntrada/MSaída/MMultiplicador face ao DeepSeek V4 Flash
DeepSeek V4 Flash$0,14$0,281x
DeepSeek V4 Pro$0,435$0,87~3x
GPT-5.6 Luna$0,20$1,201,4x / 4,3x mais caro
GPT-5.6 Terra$2,00$12,0014x / 43x mais caro
Gemini 3.1 Pro$2,00 (abaixo de 200K de contexto)$12,0014x / 43x mais caro
Claude Sonnet 5$2,00*$10,00*14x / 36x mais caro
GPT-5.6 Sol$5,00$30,0036x / 107x mais caro
Claude Opus 5$5,00$25,0036x / 89x mais caro

* O Claude Sonnet 5 está a $2/$10 numa tarifa introdutória válida até 31 de agosto de 2026, após o que passa para $3/$15. Note como a classificação depende muito do nível: os modelos de fronteira continuam 36x mais caros na entrada, mas o corte da OpenAI em julho de 2026 baixou o Luna para $0,20, o que aproxima suficientemente os preços para que o custo por token já não seja o único argumento.

O DeepSeek não é sempre o modelo mais inteligente numa tabela de avaliação, mas em preço por token útil nada se aproxima. Para cargas de trabalho de grande volume como pipelines de conteúdo, resumo, classificação e RAG sobre grandes corpora, o DeepSeek é frequentemente o único modelo que torna a economia unitária viável. Para a comparação completa incluindo os níveis de subscrição mensal, consulte a nossa comparação completa de preços de IA. Para uma análise frente a frente em capacidades, precisão e onde cada modelo vence, leia a nossa comparação DeepSeek vs ChatGPT.

Como otimizar os custos da API do DeepSeek

Algumas medidas simples podem reduzir uma fatura do DeepSeek em 50 a 90 por cento.

  1. Fixe o seu prompt de sistema. Os cache hits são 98% mais baratos no V4 Flash. Mantenha o mesmo contexto inicial em todos os pedidos.
  2. Use o V4 Flash por predefinição. Recorra ao V4 Pro apenas quando a tarefa exige realmente profundidade de raciocínio.
  3. Limite a sua saída. Paga por token de saída, por isso defina max_tokens para o valor mais baixo que ainda funcione.
  4. Mantenha as tarefas em lote fora do horário comercial de Pequim. Quando a sobretaxa de 2x no horário de pico entrar em vigor, as janelas mais caras serão das 9:00 às 12:00 e das 14:00 às 18:00, hora de Pequim (UTC+8). Agendar tarefas pesadas fora dessas janelas não custa nada hoje e reduz a fatura para metade quando a medida entrar em vigor.
  5. Use o contexto de 1M do V4 com critério. Uma janela de contexto longa não tem custo extra no modelo de preços do DeepSeek, pelo que pode incluir mais resultados de recuperação em vez de pagar por rondas repetidas.
  6. Experimente primeiro os destilados gratuitos do OpenRouter. Prototipe com os destilados R1 gratuitos e depois altere o ID do modelo quando estiver pronto para lançar.

Quer o DeepSeek sem se preocupar com chaves de API? Experimente o Fello AI

A maioria dos leitores não quer mesmo escrever código para uma API. O que querem é conversar com o melhor modelo para a tarefa sem gerir cinco subscrições, cinco separadores e cinco contextos de memória diferentes.

O Fello AI é a forma mais simples de fazer exatamente isso. Uma subscrição dá acesso ao DeepSeek, ChatGPT, Claude, Gemini, Grok, Perplexity e a vários outros modelos de topo numa única aplicação para Mac, iPhone e iPad por $9.99 por mês. Não há faturação por token a acompanhar, nem limite de utilização a gerir, nem conta separada para cada fornecedor. Tudo fica numa única janela de chat e num único histórico.

Por que razão o Fello AI funciona bem para utilizadores do DeepSeek

O DeepSeek é o modelo mais económico na API, mas o chat web oficial tem limitações e a experiência no computador é básica. O Fello AI resolve ambos. Tem o DeepSeek dentro de uma verdadeira aplicação nativa para Mac com histórico de prompts, envio de ficheiros, análise de imagens, entrada por voz e a possibilidade de mudar de modelo a meio da conversa quando o DeepSeek não é a melhor ferramenta para a próxima mensagem. Se o seu prompt ficaria melhor com a escrita do Claude ou o raciocínio do GPT, mude de modelo sem perder o contexto.

O que poupa na prática

Some o custo padrão de subscrição dos principais modelos: ChatGPT Plus a $20/mês, Claude Pro a $20/mês, Gemini Advanced a $20/mês, Perplexity Pro a $20/mês e Grok a $30/mês. Isso corresponde a cerca de $110 por mês de acesso individual. O Fello AI reúne o mesmo conjunto por $9.99 por mês, com o DeepSeek incluído na subscrição. Com mais de 25.000 avaliações de cinco estrelas na App Store e Mac App Store, é a aplicação de IA em pacote mais apreciada no ecossistema Apple.

Se preferir manter o DeepSeek separado dos restantes, temos também um guia sobre um cliente desktop do DeepSeek para Mac.

Conclusão

Os preços do DeepSeek em 2026 são os mais baixos na fronteira. O V4 Flash a $0,14/$0,28 por milhão de tokens supera todos os laboratórios ocidentais em custo por uma ordem de grandeza. O V4 Pro, agora permanentemente 75% mais barato a $0,435/$0,87, permite usar um modelo de raciocínio de topo por menos de um dólar por milhão de tokens de saída. O chat web é gratuito, a API oferece 5 milhões de tokens gratuitos, e o cache de prompts reduz os custos de entrada repetida em cerca de 98%.

Se desenvolve software, vá diretamente à página oficial de preços do DeepSeek e comece com o V4 Flash. Se apenas quer usar o DeepSeek junto com o ChatGPT, o Claude e o Gemini num único lugar, o Fello AI é a opção mais simples.

FAQ

O DeepSeek é gratuito?

Sim para utilizadores individuais. O chat web em chat.deepseek.com e a aplicação móvel oficial são gratuitos, sem nível Plus nem Pro. A API também oferece a cada nova conta um crédito de 5 milhões de tokens antes de a faturação começar.

Quanto custa a API do DeepSeek por milhão de tokens?

O DeepSeek V4 Flash custa $0,14 por milhão de tokens de entrada (cache miss) e $0,28 por milhão de tokens de saída. O V4 Pro é $0,435 na entrada e $0,87 na saída, após um corte de preço de 75% que o DeepSeek tornou permanente.

Qual é a diferença de preços entre o V4 Flash e o V4 Pro?

O V4 Flash é o modelo económico a $0,14/$0,28 por milhão de tokens. O V4 Pro é o modelo de raciocínio principal e custa cerca de 3 vezes mais, a $0,435/$0,87 por milhão de tokens.

Os preços do DeepSeek são mais baratos do que os do ChatGPT ou Claude?

Depende do nível que se compara. Face aos modelos de topo como o GPT-5.6 Sol ($5/$30) ou o Claude Opus 5 ($5/$25), o V4 Flash é 36x mais barato na entrada. Face ao nível mais económico da OpenAI, o GPT-5.6 Luna a $0,20/$1,20 desde o corte de julho de 2026, a diferença estreita-se para 1,4x na entrada e 4,3x na saída. O DeepSeek continua mais barato em todo o lado, apenas já não pela ordem de grandeza de antes.

Quais são os preços do DeepSeek no OpenRouter?

O OpenRouter replica as tarifas diretas do DeepSeek para o V4 Flash e V4 Pro, e adiciona vários modelos destilados gratuitos para prototipagem com limites de taxa mas sem custos de tokens.

O DeepSeek cobra extra pela janela de contexto de 1 milhão de tokens?

Não. O contexto completo de 1M está incluído na tarifa normal de tokens tanto no V4 Flash como no V4 Pro.