Les tarifs DeepSeek en 2026 s'articulent en quatre niveaux : un chat web gratuit sur chat.deepseek.com, l'API phare DeepSeek V4.1 Flash à $0.15/$0.60 par million de tokens en heures creuses, DeepSeek V4 Pro à $0.66/$1.98 par million de tokens en heures creuses, et un crédit API gratuit de 5 millions de tokens pour chaque nouveau compte développeur. Tous les modèles V4 intègrent nativement une fenêtre de contexte de 1 million de tokens sans surcoût, ce qui place V4.1 Flash à 27x à 33x moins cher en entrée et 33x à 42x moins cher en sortie qu'un modèle haut de gamme comme GPT-5.6 Sol ou Claude Opus 5. L'écart est bien plus réduit face aux offres d'entrée de gamme, et face à l'offre la moins chère d'OpenAI, il n'est plus que de 1,3x en entrée.

Ce guide couvre l'intégralité des tarifs DeepSeek en 2026 : les nouveaux tarifs API V4 Flash et V4 Pro, les coûts des anciens modèles V3 et du raisonneur R1, le niveau gratuit et la modification de tarification aux heures de pointe annoncée par DeepSeek, mais sans date fixée. Nous abordons également les tarifs OpenRouter et AWS Bedrock, ainsi que la comparaison de DeepSeek avec ChatGPT, Claude et Gemini. Si vous souhaitez un abonnement unique regroupant DeepSeek et les autres grands modèles, nous en parlons également à la fin. Notre comparatif complet DeepSeek vs Claude met les deux côte à côte.

Points clés à retenir

  • DeepSeek V4.1 Flash coûte $0.15/M en entrée en heures creuses et $0.30/M en heures pleines (cache manqué), avec une sortie à $0.60 et $1.20, pour une fenêtre de contexte de 1M tokens.
  • Les prix ont augmenté le 16 août 2026. V4 Pro coûte désormais $0.66/M en entrée en heures creuses et $1.32/M en heures pleines, avec une sortie à $1.98 et $3.96. La baisse permanente de 75 % a disparu.
  • Le chat web DeepSeek est gratuit pour les utilisateurs individuels, sans abonnement Plus ou Pro.
  • L'API DeepSeek offre 5 millions de tokens gratuits à chaque nouveau compte.
  • Les accès au cache coûtent une fraction des accès sans cache : la mise en cache des prompts peut réduire la facture de 80 % ou plus.
  • L'ancienne remise hors-pointe de 50 à 75 % a été supprimée. DeepSeek l'a remplacée le 16 août 2026 par une tarification au double aux heures de pointe.

Qu'est-ce que la tarification DeepSeek ?

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-6, Claude 5, Gemini 3.8, Grok 4.7 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

La tarification DeepSeek est au token : vous êtes facturé par million de tokens de texte que le modèle lit (entrée) et génère (sortie). Il n'y a pas d'abonnements mensuels sur l'API ni de frais par siège. Depuis le 16 août 2026 à 16:00 UTC, le tarif dépend aussi du moment de l'appel. Les heures pleines vont de 01:00 à 04:00 et de 06:00 à 10:00 UTC, du lundi au vendredi, et toute autre heure est en heures creuses, à exactement la moitié du tarif. Les tarifs actuels débutent à $0.15 par million de tokens en entrée en heures creuses pour DeepSeek V4.1 Flash.

DeepSeek pratique délibérément des prix inférieurs à tous les laboratoires occidentaux. Son concurrent le plus proche sur le prix est Qwen d'Alibaba, détaillé dans notre guide des tarifs Qwen. Comme nous l'avons présenté dans notre analyse du lancement de DeepSeek V4, l'objectif affiché de la société est de proposer les prix les plus bas, grâce aux puces Huawei Ascend et Cambricon. Cela maintient les tarifs DeepSeek bien en dessous des offres phares d'OpenAI et d'Anthropic, même si les gammes d'entrée de ces laboratoires ont comblé l'essentiel de l'écart sur les tokens d'entrée.

Tarifs DeepSeek 2026 (chat gratuit, V4 Flash et V4 Pro en heures pleines et creuses)

Les tarifs DeepSeek en 2026 couvrent quatre niveaux : un chat web gratuit, deux modèles API (V4 Flash et V4 Pro), et un crédit de 5 millions de tokens offert aux nouveaux comptes développeurs. Tous les chiffres ci-dessous proviennent de la page officielle des tarifs DeepSeek et sont exprimés en USD par 1 000 000 de tokens. Notre guide sur la gratuité de DeepSeek explique pourquoi il n’existe aucune formule payante grand public.

OffrePrixModèlesContexte / limitesIdéal pour
Chat web gratuit$0V4 Flash (mode standard + mode réflexion)Limitation d'usage loyal aux heures de pointeLes particuliers qui chattent sur chat.deepseek.com ou dans l'app mobile
API V4 Flash$0.15 / $0.30 en entrée / $0.60 / $1.20 en sortie par M de tokens, heures creuses / pleinesdeepseek-flash (version 0731)Contexte 1M, sortie max 384KAPI polyvalente et économique
API V4 Pro$0.66 / $1.32 en entrée / $1.98 / $3.96 en sortie par M de tokens, heures creuses / pleinesdeepseek-v4-proContexte 1M, sortie max 384KRaisonnement de pointe à une fraction du coût des concurrents
Crédit API gratuit$0 pour 5M de tokens / 30 joursTous les modèles DeepSeekLimites de débit standard, sans carte bancaireNouveaux comptes développeurs pour évaluer l'API

Chat web DeepSeek à $0 (gratuit pour les particuliers)

Le chat web DeepSeek sur chat.deepseek.com et l'app mobile officielle sont entièrement gratuits pour les utilisateurs individuels. Il n'existe pas d'abonnement Plus, ni de niveau Pro, ni de barrière payante pour les téléchargements de fichiers ou les longues conversations. La seule contrainte est une limitation d'usage loyal : aux heures de pointe, vous pouvez voir apparaître des messages « Serveur occupé ». Les sessions de chat gratuites s'exécutent sur V4 Flash par défaut et vous permettent d'activer DeepThink pour basculer en mode réflexion de V4 Flash.

Tarifs DeepSeek V4.1 Flash

DeepSeek V4.1 Flash est le modèle API économique par défaut. Il coûte $0.15 par million de tokens en entrée en heures creuses en cas de cache manqué et $0.30 en heures pleines, la sortie étant à $0.60 et $1.20. Les accès au cache tombent à $0.003 et $0.006 par million. Il propose un mode avec et sans raisonnement sous l'identifiant deepseek-flash, avec une fenêtre de contexte d'un million de tokens et jusqu'à 384K tokens en sortie. C'est le modèle à utiliser par défaut pour tout ce qui ne demande pas de raisonnement approfondi.

L'identifiant du modèle a changé deux fois en 2026. Depuis le 31 juillet 2026, l'identifiant deepseek-v4-flash servait DeepSeek-V4-Flash-0731, la version officielle qui a remplacé l'aperçu d'avril, et Artificial Analysis a fait passer V4 Flash de 40 à 50 sur la version de l'Intelligence Index en vigueur à l'époque. Le 10 septembre 2026, cet identifiant a été retiré : il reste accepté, mais DeepSeek sert désormais ces appels avec DeepSeek-V4.1-Flash sous le nom deepseek-flash et les facture au tarif Flash. Le prix a suivi. Le tarif forfaitaire de $0.14 / $0.28 avec lequel ce modèle a été lancé a été supprimé le 16 août 2026, et le tarif qui l'a remplacé a lui-même été baissé le 10 septembre 2026 : tout coût par tâche calculé avant cette date n'est donc plus valable.

Tarifs DeepSeek V4 Pro

DeepSeek V4 Pro est le modèle de raisonnement phare. Il coûte $0.66 par million de tokens en entrée en heures creuses en cas de cache manqué et $1.32 en heures pleines, avec les accès au cache à $0.022 et $0.044, et la sortie à $1.98 et $3.96. V4 Pro partage la même fenêtre de 1M et les 384K de sortie maximale que V4 Flash, et son identifiant est deepseek-v4-pro. Il reste bien moins cher que n'importe quel modèle phare occidental, mais la baisse de 75 % que DeepSeek qualifiait de permanente a pris fin en août 2026.

Crédit API gratuit DeepSeek à $0 (5 millions de tokens pendant 30 jours)

Chaque nouveau compte développeur DeepSeek démarre avec un crédit de 5 millions de tokens valable 30 jours, sans carte bancaire requise. C'est suffisant pour environ 2 500 à 5 000 appels de test selon la longueur des prompts, soit une valeur d'environ $8.40 aux tarifs actuels de V4 Flash. Une fois le crédit épuisé, la facturation bascule vers les tarifs standard au token présentés ci-dessus, et vous pouvez recharger votre solde avec un petit dépôt.

Détail par million de tokens DeepSeek (cache manqué vs accès au cache)

ModèleEntrée (cache manqué), heures creuses / heures pleinesEntrée (accès au cache), heures creuses / heures pleinesSortie, heures creuses / heures pleinesContexteNotes
deepseek-flash$0.15 / $0.30$0.003 / $0.006$0.60 / $1.201MModèle économique par défaut, sert la version 0731
deepseek-v4-pro$0.66 / $1.32$0.022 / $0.044$1.98 / $3.961MModèle de raisonnement phare
Tarifs de lancement V3 (deepseek-chat)$0.27$0.07$1.1064KHistorique. Identifiant retiré le 24 juillet 2026
Tarifs de lancement R1 (deepseek-reasoner)$0.55$0.14$2.1964KHistorique. Identifiant retiré le 24 juillet 2026

Les identifiants de modèle deepseek-chat et deepseek-reasoner pré-V4 sont supprimés. Ils ont été retirés après le 24 juillet 2026 à 15:59 UTC, et la documentation de DeepSeek ne liste désormais que deux identifiants de modèle, deepseek-flash et deepseek-v4-pro. Si ces chaînes figurent encore dans un fichier de configuration, les appels échoueront. Les tarifs V3 et R1 ci-dessous sont conservés à titre historique uniquement.

Tarifs V4 Flash vs V4 Pro

DeepSeek V4 Flash est le modèle polyvalent, rapide et économique. V4 Pro est le modèle de réflexion approfondie, avec un nombre de paramètres actifs bien plus élevé. V4 Pro coûte environ 4 fois plus cher en entrée et un peu plus de 3 fois plus cher en sortie par token que Flash : partez donc sur Flash par défaut et passez à Pro uniquement quand la tâche nécessite vraiment un raisonnement poussé. Même ainsi, V4 Pro reste le modèle de raisonnement de pointe le moins cher du marché.

Comment fonctionne la tarification DeepSeek ?

La tarification DeepSeek comporte trois niveaux, et vous pouvez réaliser des économies à chacun d'eux.

  1. Les tokens. Chaque requête est mesurée en tokens d'entrée (ce que vous envoyez) et en tokens de sortie (ce que le modèle génère). Un million de tokens représente environ 750 000 mots en anglais.
  2. Les accès au cache. Si une partie de votre prompt a déjà été traitée récemment, DeepSeek la sert depuis le cache avec une forte remise (environ 98 % de réduction par rapport au tarif sans cache sur V4 Flash). Les prompts système et les contextes partagés en bénéficient le plus.
  3. Supplément aux heures de pointe, en vigueur. La remise hors-pointe de V3 et R1 a pris fin avec ces endpoints. DeepSeek l'a remplacée le 16 août 2026 par une tarification heures de pointe / hors-pointe où les heures de pointe coûtent 2x le tarif hors-pointe, sur tous les éléments de facturation. La pointe est définie comme 9h00 à 12h00 et 14h00 à 18h00 (heure de Pékin), soit 01h00 à 04h00 et 06h00 à 10h00 UTC, du lundi au vendredi. Budgétisez au tarif de pointe tout ce qui tourne dans ces créneaux.

Vous ne payez que ce que vous utilisez. Il n'y a pas de dépense minimale, pas d'abonnement mensuel, et la longueur de la fenêtre de contexte en elle-même n'est pas facturée.

DeepSeek est-il gratuit ? Niveau gratuit et chat web

Oui, DeepSeek propose des options gratuites. L'expérience de chat grand public sur chat.deepseek.com et dans l'app mobile officielle est entièrement gratuite pour les utilisateurs individuels. Il n'existe pas d'abonnement Plus, ni de niveau Pro, ni de barrière payante pour les téléchargements de fichiers ou les longues conversations. La seule contrainte est une limitation d'usage loyal : aux heures de pointe, vous pouvez voir apparaître des messages « Serveur occupé ».

Pour les développeurs, l'API inclut un crédit de 5 millions de tokens pour les nouveaux inscrits, valable 30 jours. C'est suffisant pour 2 500 à 5 000 appels de test selon la longueur des prompts, soit environ $8.40 aux tarifs actuels de V4 Flash. Aucune carte bancaire n'est requise, et une fois le crédit épuisé, la facturation bascule vers les tarifs standard au token présentés ci-dessus.

Tarifs DeepSeek sur OpenRouter, AWS Bedrock et Azure

Si vous ne souhaitez pas utiliser l'API propre à DeepSeek, plusieurs fournisseurs tiers hébergent les mêmes modèles. Les prix varient, car chaque plateforme applique sa propre marge, ses coûts d'infrastructure et de routage.

FournisseurModèleEntrée/MSortie/MNotes
OpenRouterDeepSeek V4 ProvariablevariableRoute tierce, tarifée indépendamment des heures pleines et creuses de DeepSeek
OpenRouterDeepSeek V4 FlashvariablevariableRoute tierce, tarifée indépendamment des heures pleines et creuses de DeepSeek
OpenRouterDeepSeek V3.2$0.252$0.378Option intermédiaire héritée
OpenRouterDeepSeek R1 (raisonnement)$0.70$2.50Modèle R1 original à chaîne de pensée
AWS BedrockDeepSeek V3.2$0.62$1.85Plus élevé que le direct, mais adapté aux entreprises
Azure AI FoundryDeepSeek (divers)variablevariableLes tarifs dépendent de la région et du SKU

OpenRouter propose également plusieurs modèles distillés DeepSeek gratuits, dont les plus petits distillats R1 et DeepSeek V3 Base, avec des limites de débit mais sans frais de tokens. Ils sont idéaux pour le prototypage.

Tarifs DeepSeek R1 vs V3

C'est l'une des questions les plus fréquentes sur les tarifs DeepSeek. La réponse courte : R1 raisonne mieux mais coûte environ 5 fois plus cher par requête. À sa sortie, nous détaillerons les tarifs DeepSeek R2 dès que les tarifs officiels seront publiés.

ModèleEntrée/M, heures creuses / heures pleinesSortie/M, heures creuses / heures pleinesIdéal pour
DeepSeek V3 (ancien deepseek-chat)$0.27$1.10Chat généraliste, résumés, rédaction
DeepSeek R1 (ancien deepseek-reasoner)$0.55$2.19Mathématiques, logique, raisonnement multi-étapes
DeepSeek V4 Flash$0.15 / $0.30$0.60 / $1.20Remplace V3, moins cher et contexte plus grand
DeepSeek V4 Pro$0.66 / $1.32$1.98 / $3.96Remplace R1, raisonnement de pointe

R1 génère beaucoup plus de tokens en sortie par requête, car il produit une chaîne de pensée avant sa réponse finale. Cela creuse l'écart de prix en pratique. Avec V4, Flash et Pro prennent en charge les modes réflexion et standard, ce qui permet de choisir la profondeur de raisonnement requête par requête. Pour en savoir plus sur le raisonneur d'origine, consultez notre analyse complète de DeepSeek-R1 et comment il a surpassé OpenAI.

Comparaison des tarifs DeepSeek avec GPT-5.6, Claude et Gemini

ModèleEntrée/M, heures creuses / heures pleinesSortie/M, heures creuses / heures pleinesMultiplicateur vs DeepSeek V4.1 Flash (heures creuses)
DeepSeek V4 Flash$0.15 / $0.30$0.60 / $1.201x
DeepSeek V4 Pro$0.66 / $1.32$1.98 / $3.964,4x / 3,3x
GPT-5.6 Luna$0.20$1.201,3x / 2x
GPT-5.6 Terra$2.00$12.0013,3x / 20x
Gemini 3.1 Pro$2.00 (sous 200K de contexte)$12.0013,3x / 20x
Claude Sonnet 5$2.00*$10.00*13,3x / 16,7x
GPT-5.6 Sol$4.00$20.0026,7x / 33,3x
Claude Opus 5$5.00$25.0033,3x / 41,7x

* Claude Sonnet 5 est à $2/$10 au tarif introductif. Il devait passer à $3/$15 le 1er septembre 2026, mais Anthropic a annulé la hausse le 10 août 2026. Notez à quel point le classement dépend du niveau choisi : les modèles de pointe restent 36 fois plus chers en entrée, mais la baisse de prix d'OpenAI en juillet 2026 a ramené Luna à $0.20, ce qui est suffisamment proche pour que le prix brut au token ne soit plus le seul argument.

DeepSeek n'est pas toujours le modèle le plus performant sur un benchmark, mais sur le prix par token utile, rien d'autre n'en approche. Pour les charges de travail volumineuses comme les pipelines de contenu, la synthèse, la classification et le RAG sur de grands corpus, DeepSeek est souvent le seul modèle permettant de rentabiliser l'économie unitaire. Pour la comparaison complète incluant les niveaux d'abonnement mensuel, consultez notre comparatif complet des tarifs IA. Et pour une confrontation sur les capacités, la précision et les points forts de chaque modèle, lisez notre comparaison DeepSeek vs ChatGPT.

Comment optimiser les coûts de l'API DeepSeek

Quelques ajustements rapides peuvent réduire la facture DeepSeek de 50 à 90 %.

  1. Épinglez votre prompt système. Les accès au cache sont 98 % moins chers sur V4 Flash. Conservez le même contexte d'ouverture entre les requêtes.
  2. Utilisez V4 Flash par défaut. Ne passez à V4 Pro que lorsque la tâche nécessite vraiment un raisonnement approfondi.
  3. Limitez la sortie. Vous payez par token en sortie, alors réglez max_tokens à la valeur minimale qui fonctionne encore.
  4. Planifiez les traitements par lots en dehors des heures de bureau de Pékin. Les créneaux coûteux sont 9h00 à 12h00 et 14h00 à 18h00 (heure de Pékin, UTC+8), soit 01h00 à 04h00 et 06h00 à 10h00 UTC, du lundi au vendredi. Planifier les tâches lourdes en dehors de ces créneaux divise la facture par deux, et ce depuis le 16 août 2026.
  5. Exploitez intelligemment le contexte 1M de V4. Une grande fenêtre de contexte n'est pas facturée en supplément dans la tarification DeepSeek : vous pouvez donc y intégrer davantage de résultats de récupération plutôt que de payer pour des allers-retours répétés.
  6. Testez d'abord avec les distillats gratuits d'OpenRouter. Prototypez sur les distillats R1 gratuits, puis changez l'identifiant de modèle au moment de passer en production.

Vous voulez DeepSeek sans gérer de clés API ? Essayez Fello AI

La plupart des lecteurs ne souhaitent pas réellement écrire du code contre une API. Ils veulent dialoguer avec le meilleur modèle pour la tâche, sans jongler avec cinq abonnements, cinq onglets et cinq contextes de mémoire différents.

Fello AI est la solution la plus simple pour y parvenir. Un abonnement vous donne accès à DeepSeek, ChatGPT, Claude, Gemini, Grok, Perplexity et plusieurs autres modèles de pointe dans une seule app pour Mac, iPhone et iPad, à $9.99 par mois. Pas de facturation au token à surveiller, pas de plafond d'utilisation à gérer, et pas de compte séparé à administrer pour chaque fournisseur. Tout se trouve dans une seule fenêtre de chat et un seul historique.

Pourquoi Fello AI convient parfaitement aux utilisateurs de DeepSeek

DeepSeek reste l’un des modèles sérieux les moins chers sur l'API, mais le chat web officiel est limité et l'expérience bureau est minimaliste. Fello AI résout les deux problèmes. Vous bénéficiez de DeepSeek dans une vraie app native Mac avec historique des prompts, téléchargement de fichiers, analyse d'images, saisie vocale et la possibilité de changer de modèle en cours de conversation lorsque DeepSeek n'est pas l'outil adapté au message suivant. Si votre prompt serait mieux traité par la plume de Claude ou le raisonnement de GPT, changez de modèle sans perdre le contexte.

Ce que cela vous fait réellement économiser

Additionnez le coût standard des abonnements aux principaux modèles : ChatGPT Plus à $20/mois, Claude Pro à $20/mois, Gemini Advanced à $20/mois, Perplexity Pro à $20/mois et Grok à $30/mois. Cela représente environ $110 par mois pour un accès individuel. Fello AI regroupe la même sélection pour $9.99 par mois, avec DeepSeek inclus dans le forfait. Avec plus de 25 000 avis cinq étoiles sur l'App Store et le Mac App Store, c'est l'app de bundle IA la plus appréciée de l'écosystème Apple.

Si vous préférez utiliser DeepSeek séparément des autres, nous avons également un guide dédié au client desktop DeepSeek pour Mac.

Conclusion

Les tarifs DeepSeek en 2026 restent parmi les plus bas à la frontière technologique, mais ce n'est plus un tarif unique. V4.1 Flash à $0.15/$0.60 en heures creuses, ou $0.30/$1.20 en heures pleines, surpasse encore tous les laboratoires occidentaux sur le coût, et V4 Pro à $0.66/$1.98 en heures creuses maintient un modèle de raisonnement de premier plan sous les deux dollars par million de tokens en sortie. Ce qui a changé le 16 août 2026, c'est que votre facture dépend désormais de l'heure, et le 10 septembre 2026 le tarif Flash a de nouveau baissé. Le chat web reste gratuit, l'API offre 5 millions de tokens, et la mise en cache des prompts réduit en plus le coût des entrées répétées d'environ 98 %.

Si vous développez des logiciels, rendez-vous directement sur la page officielle des tarifs DeepSeek et commencez avec V4 Flash. Si vous souhaitez simplement utiliser DeepSeek aux côtés de ChatGPT, Claude et Gemini au même endroit, Fello AI est la solution la plus simple.

FAQ

DeepSeek est-il gratuit ?

Oui, pour les utilisateurs individuels. Le chat web sur chat.deepseek.com et l'app mobile officielle sont gratuits, sans abonnement Plus ou Pro. L'API offre également à chaque nouveau compte un crédit de 5 millions de tokens avant le début de la facturation.

Combien coûte l'API DeepSeek par million de tokens ?

DeepSeek V4.1 Flash coûte $0.15 par million de tokens en entrée en heures creuses et $0.30 en heures pleines en cas de cache manqué, avec une sortie à $0.60 et $1.20. V4 Pro est à $0.66 à $1.32 en entrée et $1.98 à $3.96 en sortie. Les heures pleines vont de 01:00 à 04:00 et de 06:00 à 10:00 UTC, du lundi au vendredi.

Quelle est la différence de tarif entre V4 Flash et V4 Pro ?

V4.1 Flash est le modèle polyvalent économique à $0.15/$0.60 par million de tokens en heures creuses. V4 Pro est le modèle de raisonnement phare et coûte environ 4 fois plus cher en entrée et un peu plus de 3 fois plus cher en sortie, à $0.66/$1.98 en heures creuses. Les deux doublent en heures pleines.

Les tarifs DeepSeek sont-ils moins chers que ChatGPT ou Claude ?

Cela dépend du niveau comparé et du moment de l'appel. Face aux modèles phares comme GPT-5.6 Sol ($4/$20) ou Claude Opus 5 ($5/$25), V4.1 Flash est 27 à 33 fois moins cher en entrée en heures creuses, et moitié moins en heures pleines. Face au niveau le moins cher d'OpenAI, GPT-5.6 Luna à $0.20/$1.20, l'écart est faible : V4.1 Flash est environ 1,3 fois moins cher en entrée et 2 fois moins cher en sortie. DeepSeek reste bien moins cher que les grands modèles, mais plus d'un ordre de grandeur.

Quels sont les tarifs DeepSeek sur OpenRouter ?

OpenRouter applique les mêmes tarifs directs que DeepSeek pour V4 Flash et V4 Pro, et propose plusieurs modèles distillés gratuits pour le prototypage, avec des limites de débit mais sans frais de tokens.

DeepSeek facture-t-il un supplément pour la fenêtre de contexte de 1 million de tokens ?

Non. Le contexte complet de 1M est inclus dans le tarif standard au token, aussi bien pour V4 Flash que pour V4 Pro.