Les tarifs DeepSeek en 2026 s'articulent en quatre niveaux : un chat web gratuit sur chat.deepseek.com, l'API phare DeepSeek V4 Flash à $0.14/$0.28 par million de tokens, DeepSeek V4 Pro à $0.435/$0.87 par million de tokens, et un crédit API gratuit de 5 millions de tokens pour chaque nouveau compte développeur. Tous les modèles V4 intègrent nativement une fenêtre de contexte de 1 million de tokens sans surcoût, ce qui place V4 Flash à 36x moins cher en entrée et 107x moins cher en sortie qu'un modèle haut de gamme comme GPT-5.6 Sol ou Claude Opus 5. L'écart est bien plus réduit face aux offres d'entrée de gamme, et depuis la baisse de prix d'OpenAI en juillet, il n'est plus que de 1,4x en entrée.

Ce guide couvre l'intégralité des tarifs DeepSeek en 2026 : les nouveaux tarifs API V4 Flash et V4 Pro, les coûts des anciens modèles V3 et du raisonneur R1, le niveau gratuit et la modification de tarification aux heures de pointe annoncée par DeepSeek, mais sans date fixée. Nous abordons également les tarifs OpenRouter et AWS Bedrock, ainsi que la comparaison de DeepSeek avec ChatGPT, Claude et Gemini. Si vous souhaitez un abonnement unique regroupant DeepSeek et les autres grands modèles, nous en parlons également à la fin.

Points clés à retenir

  • DeepSeek V4 Flash coûte $0.14/M en entrée (cache manqué) et $0.28/M en sortie, avec une fenêtre de contexte de 1M tokens. Cet identifiant sert désormais la version 0731, au même prix.
  • DeepSeek V4 Pro coûte $0.435/M en entrée et $0.87/M en sortie, après une baisse de prix permanente de 75 %.
  • Le chat web DeepSeek est gratuit pour les utilisateurs individuels, sans abonnement Plus ou Pro.
  • L'API DeepSeek offre 5 millions de tokens gratuits à chaque nouveau compte.
  • Les accès au cache coûtent une fraction des accès sans cache : la mise en cache des prompts peut réduire la facture de 80 % ou plus.
  • L'ancienne remise hors-pointe de 50 à 75 % a été supprimée. DeepSeek annonce qu'il va adopter une tarification au double aux heures de pointe, sans date annoncée pour l'instant.

Qu'est-ce que la tarification DeepSeek ?

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

La tarification DeepSeek est au token : vous êtes facturé par million de tokens de texte que le modèle lit (entrée) et génère (sortie). Il n'y a pas d'abonnements mensuels sur l'API ni de frais par siège. Les tarifs actuels débutent à $0.14 par million de tokens en entrée pour DeepSeek V4 Flash et atteignent quelques dollars par million pour le modèle haut de gamme V4 Pro.

DeepSeek pratique délibérément des prix inférieurs à tous les laboratoires occidentaux. Son concurrent le plus proche sur le prix est Qwen d'Alibaba, détaillé dans notre guide des tarifs Qwen. Comme nous l'avons présenté dans notre analyse du lancement de DeepSeek V4, l'objectif affiché de la société est de proposer les prix les plus bas, grâce aux puces Huawei Ascend et Cambricon. Cela maintient les tarifs DeepSeek bien en dessous des offres phares d'OpenAI et d'Anthropic, même si les gammes d'entrée de ces laboratoires ont comblé l'essentiel de l'écart sur les tokens d'entrée.

Tarifs DeepSeek 2026 (chat gratuit, V4 Flash à $0.14/$0.28, V4 Pro à $0.435/$0.87)

Les tarifs DeepSeek en 2026 couvrent quatre niveaux : un chat web gratuit, deux modèles API (V4 Flash et V4 Pro), et un crédit de 5 millions de tokens offert aux nouveaux comptes développeurs. Tous les chiffres ci-dessous proviennent de la page officielle des tarifs DeepSeek et sont exprimés en USD par 1 000 000 de tokens.

OffrePrixModèlesContexte / limitesIdéal pour
Chat web gratuit$0V4 Flash (mode standard + mode réflexion)Limitation d'usage loyal aux heures de pointeLes particuliers qui chattent sur chat.deepseek.com ou dans l'app mobile
API V4 Flash$0.14 en entrée / $0.28 en sortie par M de tokensdeepseek-v4-flash (version 0731)Contexte 1M, sortie max 384KAPI polyvalente et économique
API V4 Pro$0.435 en entrée / $0.87 en sortie par M de tokensdeepseek-v4-proContexte 1M, sortie max 384KRaisonnement de pointe à une fraction du coût des concurrents
Crédit API gratuit$0 pour 5M de tokens / 30 joursTous les modèles DeepSeekLimites de débit standard, sans carte bancaireNouveaux comptes développeurs pour évaluer l'API

Chat web DeepSeek à $0 (gratuit pour les particuliers)

Le chat web DeepSeek sur chat.deepseek.com et l'app mobile officielle sont entièrement gratuits pour les utilisateurs individuels. Il n'existe pas d'abonnement Plus, ni de niveau Pro, ni de barrière payante pour les téléchargements de fichiers ou les longues conversations. La seule contrainte est une limitation d'usage loyal : aux heures de pointe, vous pouvez voir apparaître des messages « Serveur occupé ». Les sessions de chat gratuites s'exécutent sur V4 Flash par défaut et vous permettent d'activer DeepThink pour basculer en mode réflexion de V4 Flash.

DeepSeek V4 Flash à $0.14 / $0.28 par million de tokens

DeepSeek V4 Flash est le modèle API économique par défaut. Il coûte $0.14 par million de tokens en entrée en cas de cache manqué et $0.28 par million de tokens en sortie, les accès au cache étant réduits à seulement $0.0028 par million (une remise de 98 %). V4 Flash prend en charge un mode standard et un mode réflexion sous l'identifiant deepseek-v4-flash, et intègre une fenêtre de contexte de 1 million de tokens ainsi qu'une sortie pouvant atteindre 384K tokens. C'est le modèle à utiliser par défaut pour tout ce qui ne nécessite pas de raisonnement approfondi.

Depuis le 31 juillet 2026, cet identifiant sert DeepSeek-V4-Flash-0731, la version officielle qui a remplacé l'aperçu d'avril. Le prix n'a pas changé, mais les performances, si : Artificial Analysis a fait passer V4 Flash de 40 à 50 sur son Intelligence Index, ce qui représente $0.03 par tâche d'index, le chiffre le plus bas de ce classement. Gemini 3.6 Flash obtient le même score de 50 et coûte $0.56 par tâche, soit environ 19 fois plus. Un bémol à garder en tête : ce score provient d'un seul classement, il date de quelques jours, et V4 Flash n'a encore aucun vote sur les classements de préférence humaine.

DeepSeek V4 Pro à $0.435 / $0.87 par million de tokens

DeepSeek V4 Pro est le modèle de raisonnement phare. Après une baisse de prix permanente de 75 % décidée par DeepSeek, il coûte $0.435 par million de tokens en entrée (cache manqué), $0.003625 par million en cas d'accès au cache et $0.87 par million de tokens en sortie. V4 Pro partage le même contexte 1M et la même sortie max de 384K que V4 Flash, et son identifiant de modèle est deepseek-v4-pro. À ces tarifs, c'est le modèle de raisonnement de pointe le moins cher du marché.

Crédit API gratuit DeepSeek à $0 (5 millions de tokens pendant 30 jours)

Chaque nouveau compte développeur DeepSeek démarre avec un crédit de 5 millions de tokens valable 30 jours, sans carte bancaire requise. C'est suffisant pour environ 2 500 à 5 000 appels de test selon la longueur des prompts, soit une valeur d'environ $8.40 aux tarifs actuels de V4 Flash. Une fois le crédit épuisé, la facturation bascule vers les tarifs standard au token présentés ci-dessus, et vous pouvez recharger votre solde avec un petit dépôt.

Détail par million de tokens DeepSeek (cache manqué vs accès au cache)

ModèleEntrée (cache manqué)Entrée (accès au cache)SortieContexteNotes
deepseek-v4-flash$0.14$0.0028$0.281MModèle économique par défaut, sert la version 0731
deepseek-v4-pro$0.435$0.003625$0.871MModèle de raisonnement phare (baisse permanente de 75 %)
Tarifs de lancement V3 (deepseek-chat)$0.27$0.07$1.1064KHistorique. Identifiant retiré le 24 juillet 2026
Tarifs de lancement R1 (deepseek-reasoner)$0.55$0.14$2.1964KHistorique. Identifiant retiré le 24 juillet 2026

Les identifiants de modèle deepseek-chat et deepseek-reasoner pré-V4 sont supprimés. Ils ont été retirés après le 24 juillet 2026 à 15:59 UTC, et la documentation de DeepSeek ne liste désormais que deux identifiants de modèle, deepseek-v4-flash et deepseek-v4-pro. Si ces chaînes figurent encore dans un fichier de configuration, les appels échoueront. Les tarifs V3 et R1 ci-dessous sont conservés à titre historique uniquement.

Tarifs V4 Flash vs V4 Pro

DeepSeek V4 Flash est le modèle polyvalent, rapide et économique. V4 Pro est le modèle de réflexion approfondie, avec un nombre de paramètres actifs bien plus élevé. V4 Pro coûte environ 3 fois plus cher par token que Flash : partez donc sur Flash par défaut et passez à Pro uniquement quand la tâche nécessite vraiment un raisonnement poussé. Même à 3x, V4 Pro reste le modèle de raisonnement de pointe le moins cher du marché.

Comment fonctionne la tarification DeepSeek ?

La tarification DeepSeek comporte trois niveaux, et vous pouvez réaliser des économies à chacun d'eux.

  1. Les tokens. Chaque requête est mesurée en tokens d'entrée (ce que vous envoyez) et en tokens de sortie (ce que le modèle génère). Un million de tokens représente environ 750 000 mots en anglais.
  2. Les accès au cache. Si une partie de votre prompt a déjà été traitée récemment, DeepSeek la sert depuis le cache avec une forte remise (environ 98 % de réduction par rapport au tarif sans cache sur V4 Flash). Les prompts système et les contextes partagés en bénéficient le plus.
  3. Supplément aux heures de pointe, à venir. La remise hors-pointe de V3 et R1 a pris fin avec ces endpoints. La documentation de DeepSeek indique désormais qu'il adoptera une tarification heures de pointe / hors-pointe où les heures de pointe coûteront 2x le tarif normal, sur tous les éléments de facturation, à une date qu'il n'a pas encore annoncée. La pointe est définie comme 9h00 à 12h00 et 14h00 à 18h00 (heure de Pékin). Rien n'a encore changé sur la grille tarifaire, alors budgétisez aux tarifs standard et surveillez la documentation.

Vous ne payez que ce que vous utilisez. Il n'y a pas de dépense minimale, pas d'abonnement mensuel, et la longueur de la fenêtre de contexte en elle-même n'est pas facturée.

DeepSeek est-il gratuit ? Niveau gratuit et chat web

Oui, DeepSeek propose des options gratuites. L'expérience de chat grand public sur chat.deepseek.com et dans l'app mobile officielle est entièrement gratuite pour les utilisateurs individuels. Il n'existe pas d'abonnement Plus, ni de niveau Pro, ni de barrière payante pour les téléchargements de fichiers ou les longues conversations. La seule contrainte est une limitation d'usage loyal : aux heures de pointe, vous pouvez voir apparaître des messages « Serveur occupé ».

Pour les développeurs, l'API inclut un crédit de 5 millions de tokens pour les nouveaux inscrits, valable 30 jours. C'est suffisant pour 2 500 à 5 000 appels de test selon la longueur des prompts, soit environ $8.40 aux tarifs actuels de V4 Flash. Aucune carte bancaire n'est requise, et une fois le crédit épuisé, la facturation bascule vers les tarifs standard au token présentés ci-dessus.

Tarifs DeepSeek sur OpenRouter, AWS Bedrock et Azure

Si vous ne souhaitez pas utiliser l'API propre à DeepSeek, plusieurs fournisseurs tiers hébergent les mêmes modèles. Les prix varient, car chaque plateforme applique sa propre marge, ses coûts d'infrastructure et de routage.

FournisseurModèleEntrée/MSortie/MNotes
OpenRouterDeepSeek V4 Pro$0.435$0.87Correspond aux tarifs directs de DeepSeek
OpenRouterDeepSeek V4 Flash$0.14$0.28Correspond aux tarifs directs
OpenRouterDeepSeek V3.2$0.252$0.378Option intermédiaire héritée
OpenRouterDeepSeek R1 (raisonnement)$0.70$2.50Modèle R1 original à chaîne de pensée
AWS BedrockDeepSeek V3.2$0.62$1.85Plus élevé que le direct, mais adapté aux entreprises
Azure AI FoundryDeepSeek (divers)variablevariableLes tarifs dépendent de la région et du SKU

OpenRouter propose également plusieurs modèles distillés DeepSeek gratuits, dont les plus petits distillats R1 et DeepSeek V3 Base, avec des limites de débit mais sans frais de tokens. Ils sont idéaux pour le prototypage.

Tarifs DeepSeek R1 vs V3

C'est l'une des questions les plus fréquentes sur les tarifs DeepSeek. La réponse courte : R1 raisonne mieux mais coûte environ 5 fois plus cher par requête. À sa sortie, nous détaillerons les tarifs DeepSeek R2 dès que les tarifs officiels seront publiés.

ModèleEntrée/MSortie/MIdéal pour
DeepSeek V3 (ancien deepseek-chat)$0.27$1.10Chat généraliste, résumés, rédaction
DeepSeek R1 (ancien deepseek-reasoner)$0.55$2.19Mathématiques, logique, raisonnement multi-étapes
DeepSeek V4 Flash$0.14$0.28Remplace V3, moins cher et contexte plus grand
DeepSeek V4 Pro$0.435$0.87Remplace R1, raisonnement de pointe

R1 génère beaucoup plus de tokens en sortie par requête, car il produit une chaîne de pensée avant sa réponse finale. Cela creuse l'écart de prix en pratique. Avec V4, Flash et Pro prennent en charge les modes réflexion et standard, ce qui permet de choisir la profondeur de raisonnement requête par requête. Pour en savoir plus sur le raisonneur d'origine, consultez notre analyse complète de DeepSeek-R1 et comment il a surpassé OpenAI.

Comparaison des tarifs DeepSeek avec GPT-5.6, Claude et Gemini

ModèleEntrée/MSortie/MMultiplicateur vs DeepSeek V4 Flash
DeepSeek V4 Flash$0.14$0.281x
DeepSeek V4 Pro$0.435$0.87~3x
GPT-5.6 Luna$0.20$1.201,4x / 4,3x plus cher
GPT-5.6 Terra$2.00$12.0014x / 43x plus cher
Gemini 3.1 Pro$2.00 (sous 200K de contexte)$12.0014x / 43x plus cher
Claude Sonnet 5$2.00*$10.00*14x / 36x plus cher
GPT-5.6 Sol$5.00$30.0036x / 107x plus cher
Claude Opus 5$5.00$25.0036x / 89x plus cher

* Claude Sonnet 5 est à $2/$10 au tarif introductif, valable jusqu'au 31 août 2026, après quoi il passera à $3/$15. Notez à quel point le classement dépend du niveau choisi : les modèles de pointe restent 36 fois plus chers en entrée, mais la baisse de prix d'OpenAI en juillet 2026 a ramené Luna à $0.20, ce qui est suffisamment proche pour que le prix brut au token ne soit plus le seul argument.

DeepSeek n'est pas toujours le modèle le plus performant sur un benchmark, mais sur le prix par token utile, rien d'autre n'en approche. Pour les charges de travail volumineuses comme les pipelines de contenu, la synthèse, la classification et le RAG sur de grands corpus, DeepSeek est souvent le seul modèle permettant de rentabiliser l'économie unitaire. Pour la comparaison complète incluant les niveaux d'abonnement mensuel, consultez notre comparatif complet des tarifs IA. Et pour une confrontation sur les capacités, la précision et les points forts de chaque modèle, lisez notre comparaison DeepSeek vs ChatGPT.

Comment optimiser les coûts de l'API DeepSeek

Quelques ajustements rapides peuvent réduire la facture DeepSeek de 50 à 90 %.

  1. Épinglez votre prompt système. Les accès au cache sont 98 % moins chers sur V4 Flash. Conservez le même contexte d'ouverture entre les requêtes.
  2. Utilisez V4 Flash par défaut. Ne passez à V4 Pro que lorsque la tâche nécessite vraiment un raisonnement approfondi.
  3. Limitez la sortie. Vous payez par token en sortie, alors réglez max_tokens à la valeur minimale qui fonctionne encore.
  4. Planifiez les traitements par lots en dehors des heures de bureau de Pékin. Lorsque le supplément de 2x aux heures de pointe entrera en vigueur, les créneaux coûteux seront 9h00 à 12h00 et 14h00 à 18h00 (heure de Pékin, UTC+8). Planifier les tâches lourdes en dehors de ces créneaux ne coûte rien aujourd'hui et divise la facture par deux le jour où la mesure sera appliquée.
  5. Exploitez intelligemment le contexte 1M de V4. Une grande fenêtre de contexte n'est pas facturée en supplément dans la tarification DeepSeek : vous pouvez donc y intégrer davantage de résultats de récupération plutôt que de payer pour des allers-retours répétés.
  6. Testez d'abord avec les distillats gratuits d'OpenRouter. Prototypez sur les distillats R1 gratuits, puis changez l'identifiant de modèle au moment de passer en production.

Vous voulez DeepSeek sans gérer de clés API ? Essayez Fello AI

La plupart des lecteurs ne souhaitent pas réellement écrire du code contre une API. Ils veulent dialoguer avec le meilleur modèle pour la tâche, sans jongler avec cinq abonnements, cinq onglets et cinq contextes de mémoire différents.

Fello AI est la solution la plus simple pour y parvenir. Un abonnement vous donne accès à DeepSeek, ChatGPT, Claude, Gemini, Grok, Perplexity et plusieurs autres modèles de pointe dans une seule app pour Mac, iPhone et iPad, à $9.99 par mois. Pas de facturation au token à surveiller, pas de plafond d'utilisation à gérer, et pas de compte séparé à administrer pour chaque fournisseur. Tout se trouve dans une seule fenêtre de chat et un seul historique.

Pourquoi Fello AI convient parfaitement aux utilisateurs de DeepSeek

DeepSeek est le modèle sérieux le moins cher sur l'API, mais le chat web officiel est limité et l'expérience bureau est minimaliste. Fello AI résout les deux problèmes. Vous bénéficiez de DeepSeek dans une vraie app native Mac avec historique des prompts, téléchargement de fichiers, analyse d'images, saisie vocale et la possibilité de changer de modèle en cours de conversation lorsque DeepSeek n'est pas l'outil adapté au message suivant. Si votre prompt serait mieux traité par la plume de Claude ou le raisonnement de GPT, changez de modèle sans perdre le contexte.

Ce que cela vous fait réellement économiser

Additionnez le coût standard des abonnements aux principaux modèles : ChatGPT Plus à $20/mois, Claude Pro à $20/mois, Gemini Advanced à $20/mois, Perplexity Pro à $20/mois et Grok à $30/mois. Cela représente environ $110 par mois pour un accès individuel. Fello AI regroupe la même sélection pour $9.99 par mois, avec DeepSeek inclus dans le forfait. Avec plus de 25 000 avis cinq étoiles sur l'App Store et le Mac App Store, c'est l'app de bundle IA la plus appréciée de l'écosystème Apple.

Si vous préférez utiliser DeepSeek séparément des autres, nous avons également un guide dédié au client desktop DeepSeek pour Mac.

Conclusion

Les tarifs DeepSeek en 2026 sont les plus bas à la frontière technologique. V4 Flash à $0.14/$0.28 par million de tokens surpasse tous les laboratoires occidentaux sur le coût d'un ordre de grandeur. V4 Pro, désormais baissé de 75 % de façon permanente à $0.435/$0.87, vous permet d'utiliser un modèle de raisonnement de pointe pour moins d'un dollar par million de tokens en sortie. Le chat web reste gratuit, l'API offre 5 millions de tokens gratuits, et la mise en cache des prompts réduit en plus les coûts d'entrée répétés d'environ 98 %.

Si vous développez des logiciels, rendez-vous directement sur la page officielle des tarifs DeepSeek et commencez avec V4 Flash. Si vous souhaitez simplement utiliser DeepSeek aux côtés de ChatGPT, Claude et Gemini au même endroit, Fello AI est la solution la plus simple.

FAQ

DeepSeek est-il gratuit ?

Oui, pour les utilisateurs individuels. Le chat web sur chat.deepseek.com et l'app mobile officielle sont gratuits, sans abonnement Plus ou Pro. L'API offre également à chaque nouveau compte un crédit de 5 millions de tokens avant le début de la facturation.

Combien coûte l'API DeepSeek par million de tokens ?

DeepSeek V4 Flash coûte $0.14 par million de tokens en entrée (cache manqué) et $0.28 par million de tokens en sortie. V4 Pro est à $0.435 en entrée et $0.87 en sortie, après une baisse de prix permanente de 75 % décidée par DeepSeek.

Quelle est la différence de tarif entre V4 Flash et V4 Pro ?

V4 Flash est le modèle polyvalent économique à $0.14/$0.28 par million de tokens. V4 Pro est le modèle de raisonnement phare et coûte environ 3 fois plus cher, à $0.435/$0.87 par million de tokens.

Les tarifs DeepSeek sont-ils moins chers que ChatGPT ou Claude ?

Tout dépend du niveau comparé. Face aux modèles phares comme GPT-5.6 Sol ($5/$30) ou Claude Opus 5 ($5/$25), V4 Flash est 36 fois moins cher en entrée. Face à l'offre la moins chère d'OpenAI, GPT-5.6 Luna à $0.20/$1.20 depuis la baisse de juillet 2026, l'écart se réduit à 1,4x en entrée et 4,3x en sortie. DeepSeek reste moins cher partout, mais plus dans les mêmes proportions qu'auparavant.

Quels sont les tarifs DeepSeek sur OpenRouter ?

OpenRouter applique les mêmes tarifs directs que DeepSeek pour V4 Flash et V4 Pro, et propose plusieurs modèles distillés gratuits pour le prototypage, avec des limites de débit mais sans frais de tokens.

DeepSeek facture-t-il un supplément pour la fenêtre de contexte de 1 million de tokens ?

Non. Le contexte complet de 1M est inclus dans le tarif standard au token, aussi bien pour V4 Flash que pour V4 Pro.