DeepSeek-Preise 2026 umfassen vier Stufen: ein kostenloser Web-Chat unter chat.deepseek.com, die Flagship-API DeepSeek V4 Flash für $0.14/$0.28 pro Million Token, DeepSeek V4 Pro für $0.435/$0.87 pro Million Token und ein kostenloses API-Kontingent von 5 Millionen Token für jeden neuen Entwickler-Account. Alle V4-Modelle bringen ein natives Kontextfenster von 1 Million Token ohne Aufpreis mit, was V4 Flash 36-mal günstiger beim Input und 107-mal günstiger beim Output macht als ein Top-Modell wie GPT-5.6 Sol oder Claude Opus 5. Im Vergleich zu den günstigen Tarifen ist der Abstand deutlich kleiner, und seit OpenAIs Preissenkung im Juli ist es beim Input nur noch 1,4-fach.
Dieser Leitfaden deckt jeden Aspekt der DeepSeek-Preise 2026 ab: die neuen V4 Flash- und V4 Pro-API-Tarife, die Legacy-Preise für V3-Chat und R1-Reasoner, den kostenlosen Tarif und die angekündigte, aber noch nicht datierte Spitzenzeitpreisänderung. Außerdem behandeln wir OpenRouter- und AWS Bedrock-Preise sowie den Vergleich von DeepSeek mit ChatGPT, Claude und Gemini. Wer ein einzelnes Abonnement sucht, das DeepSeek mit den anderen Top-Modellen bündelt, findet am Ende auch dazu Infos.
Die wichtigsten Punkte
- DeepSeek V4 Flash kostet $0.14/M Input (Cache-Miss) und $0.28/M Output bei einem Kontextfenster von 1M Token. Diese ID bedient nun den 0731-Build zum gleichen Preis.
- DeepSeek V4 Pro kostet $0.435/M Input und $0.87/M Output, nach einer dauerhaften Preissenkung um 75 %.
- Der Web-Chat von DeepSeek ist kostenlos für Einzelnutzer, ohne Plus- oder Pro-Plan.
- Die DeepSeek API gibt jedem neuen Account 5 Millionen kostenlose Token.
- Cache-Treffer kosten nur einen Bruchteil eines Cache-Misses, sodass Prompt-Caching die Kosten um 80 % oder mehr senken kann.
- Der alte Nebenzeiten-Rabatt von 50 bis 75 % entfällt. DeepSeek sagt, es werde stattdessen auf 2-fache Spitzenpreise umsteigen, ohne bislang ein Datum zu nennen.
Was sind DeepSeek-Preise?
DeepSeek-Preise funktionieren nach dem Pay-per-Token-Prinzip: Du zahlst pro Million Token Text, die das Modell liest (Input) und schreibt (Output). Es gibt keine monatlichen Abonnements für die API und keine Sitzplatzgebühren. Die aktuellen Tarife beginnen bei $0.14 pro Million Input-Token für DeepSeek V4 Flash und steigen auf wenige Dollar pro Million beim High-End-Modell V4 Pro.
DeepSeek unterbietet bewusst jeden westlichen Anbieter. Der nächste Konkurrent beim Preis ist Alibabas Qwen, aufgeschlüsselt in unserem Qwen-Preisleitfaden. Wie wir in unserem DeepSeek V4 Launch-Überblick beschrieben haben, ist das erklärte Ziel des Unternehmens, mit Huawei Ascend- und Cambricon-Chips Minimalpreise zu erzielen. Das hält die DeepSeek-Preise weit unter den Flaggschiff-Tarifen von OpenAI und Anthropic, obwohl die günstigen Tiers dieser Anbieter beim Input-Token den Großteil des Abstands aufgeholt haben.
DeepSeek-Preise 2026 (Kostenloser Chat, V4 Flash bei $0.14/$0.28, V4 Pro bei $0.435/$0.87)
DeepSeek-Preise 2026 umfassen vier Stufen: einen kostenlosen Web-Chat, zwei API-Modelle (V4 Flash und V4 Pro) und ein kostenloses Kontingent von 5 Millionen Token für neue Entwickler-Accounts. Alle Zahlen unten stammen von der offiziellen DeepSeek-Preisseite und sind in USD pro 1.000.000 Token angegeben.
| Plan | Preis | Modelle | Kontext / Limits | Am besten für |
|---|---|---|---|---|
| Kostenloser Web-Chat | $0 | V4 Flash (ohne und mit Thinking) | Fair-Use-Drosselung in Stoßzeiten | Einzelnutzer, die unter chat.deepseek.com oder in der mobilen App chatten |
| V4 Flash API | $0.14 in / $0.28 out pro M Token | deepseek-v4-flash (0731 Build) | 1M Kontext, 384K max. Output | Günstiger Allzweck-API-Arbeitspferd |
| V4 Pro API | $0.435 in / $0.87 out pro M Token | deepseek-v4-pro | 1M Kontext, 384K max. Output | Frontier-Reasoning zu einem Bruchteil der Konkurrenzkosten |
| Kostenloses API-Kontingent | $0 für 5M Token / 30 Tage | Alle DeepSeek-Modelle | Standard-Rate-Limits, keine Kreditkarte | Neue Entwickler-Accounts zur API-Evaluierung |
DeepSeek-Web-Chat für $0 (kostenlos für Einzelnutzer)
Der DeepSeek-Web-Chat unter chat.deepseek.com und die offizielle mobile App sind für Einzelnutzer vollständig kostenlos. Es gibt keinen Plus-Plan, keinen Pro-Tarif und keine Bezahlschranke für Datei-Uploads oder lange Gespräche. Der einzige Nachteil ist die Fair-Use-Drosselung: In Stoßzeiten können „Server Busy"-Meldungen auftreten. Kostenlose Chat-Sitzungen laufen standardmäßig auf V4 Flash und erlauben das Umschalten auf DeepThink, um in den V4 Flash Thinking-Modus zu wechseln.
DeepSeek V4 Flash für $0.14 / $0.28 pro Million Token
DeepSeek V4 Flash ist das Standard-API-Modell im günstigen Segment. Es kostet $0.14 pro Million Input-Token bei einem Cache-Miss und $0.28 pro Million Output-Token, wobei Cache-Treffer auf nur $0.0028 pro Million fallen (98 % Rabatt). V4 Flash unterstützt unter der ID deepseek-v4-flash sowohl einen Standard- als auch einen Thinking-Modus und bringt ein Kontextfenster von 1 Million Token sowie bis zu 384K Output-Token mit. Dieses Modell ist die erste Wahl für alles, was kein tiefes Reasoning erfordert.
Seit dem 31. Juli 2026 bedient diese ID DeepSeek-V4-Flash-0731, den offiziellen Build, der die April-Vorschau ablöst. Der Preis hat sich nicht verändert, aber die Leistung schon: Artificial Analysis hat V4 Flash im Intelligence Index von 40 auf 50 angehoben, was $0.03 pro Index-Aufgabe ergibt, dem günstigsten Wert in diesem Ranking. Gemini 3.6 Flash erzielt denselben Wert von 50 und kostet $0.56 pro Aufgabe, also rund 19-mal mehr. Ein Vorbehalt: Dieses Ergebnis stammt von einem einzelnen Ranking, ist wenige Tage alt, und V4 Flash hat noch keine Stimmen auf einem Human-Preference-Leaderboard.
DeepSeek V4 Pro für $0.435 / $0.87 pro Million Token
DeepSeek V4 Pro ist das Flagship-Reasoning-Modell. Nach einer dauerhaften Preissenkung um 75 % kostet es $0.435 pro Million Input-Token (Cache-Miss), $0.003625 pro Million Cache-Treffer und $0.87 pro Million Output-Token. V4 Pro teilt denselben 1M-Kontext und 384K max. Output wie V4 Flash, und die Modell-ID lautet deepseek-v4-pro. Zu diesen Preisen ist es das günstigste Frontier-Reasoning-Modell auf dem Markt.
Kostenloses DeepSeek API-Kontingent ($0, 5 Millionen Token für 30 Tage)
Jeder neue DeepSeek-Entwickler-Account startet mit einem Kontingent von 5 Millionen Token, das 30 Tage gültig ist und keine Kreditkarte erfordert. Das reicht für etwa 2.500 bis 5.000 Testaufrufe, je nach Prompt-Länge, was zum aktuellen V4 Flash-Tarif etwa $8.40 wert ist. Nach dem Verbrauch des Kontingents wechselt die Abrechnung auf die oben genannten Standard-Pay-per-Token-Tarife, und du kannst dein Guthaben mit einer kleinen Einzahlung aufstocken.
DeepSeek-Preise im Detail pro Million Token (Cache-Miss vs. Cache-Treffer)
| Modell | Input (Cache-Miss) | Input (Cache-Treffer) | Output | Kontext | Hinweise |
|---|---|---|---|---|---|
| deepseek-v4-flash | $0.14 | $0.0028 | $0.28 | 1M | Standard-Günstigmodell, bedient den 0731 Build |
| deepseek-v4-pro | $0.435 | $0.003625 | $0.87 | 1M | Flagship-Reasoning-Modell (dauerhaft 75 % günstiger) |
V3-Einführungspreis (deepseek-chat) | $0.27 | $0.07 | $1.10 | 64K | Historisch. ID eingestellt am 24. Juli 2026 |
R1-Einführungspreis (deepseek-reasoner) | $0.55 | $0.14 | $2.19 | 64K | Historisch. ID eingestellt am 24. Juli 2026 |
Die alten Modell-IDs deepseek-chat und deepseek-reasoner sind abgekündigt. Sie wurden nach dem 24. Juli 2026, 15:59 UTC eingestellt, und DeepSeeks Dokumentation listet jetzt genau zwei Modell-IDs: deepseek-v4-flash und deepseek-v4-pro. Wer diese alten Strings noch in einer Konfigurationsdatei hat, wird Fehler erhalten. Die V3- und R1-Preise unten werden nur aus historischen Gründen aufgeführt.
V4 Flash vs. V4 Pro Preise
DeepSeek V4 Flash ist das günstige, schnelle Arbeitspferd. V4 Pro ist das Deep-Thinking-Modell mit einer deutlich höheren Anzahl aktiver Parameter. V4 Pro kostet ungefähr dreimal so viel pro Token wie Flash. Standardmäßig also Flash verwenden und nur dann auf Pro umsteigen, wenn ein Task echtes Reasoning-Tiefe benötigt. Selbst bei 3-fachem Preis ist V4 Pro das günstigste Frontier-Reasoning-Modell auf dem Markt.
Wie funktionieren DeepSeek-Preise?
DeepSeek-Preise haben drei Ebenen, auf jeder lässt sich sparen.
- Token. Jede Anfrage wird in Input-Token (was du sendest) und Output-Token (was das Modell generiert) gemessen. Eine Million Token entspricht ungefähr 750.000 englischen Wörtern.
- Cache-Treffer. Wenn ein Teil deines Prompts kürzlich bereits verarbeitet wurde, liefert DeepSeek ihn aus dem Cache mit einem deutlichen Rabatt (bei V4 Flash etwa 98 % günstiger als beim Cache-Miss). System-Prompts und gemeinsamer Kontext profitieren am meisten.
- Spitzenzeitaufschlag, kommt noch. Der Nebenzeiten-Rabatt für V3 und R1 entfiel mit diesen Endpunkten. DeepSeeks Dokumentation kündigt nun Spitzen- und Nebenzeiten-Preise an, bei denen Stoßzeiten das 2-fache des Normaltarifs kosten, auf alle Abrechnungsposten, zu einem noch nicht genannten Datum. Stoßzeiten sind als 9:00 bis 12:00 und 14:00 bis 18:00 Pekinger Zeit definiert. An den aktuellen Tarifen hat sich noch nichts geändert, also beim Standard kalkulieren und die Dokumentation im Blick behalten.
Du zahlst nur, was du verbrauchst. Es gibt kein Mindestbudget, keine Monatsgebühr und keinen Aufpreis für die Länge des Kontextfensters selbst.
Ist DeepSeek kostenlos? Kostenloser Tarif und Web-Chat
Ja, DeepSeek hat kostenlose Angebote. Das Consumer-Chat-Erlebnis unter chat.deepseek.com und in der offiziellen mobilen App ist für Einzelnutzer vollständig kostenlos. Es gibt keinen Plus-Plan, keinen Pro-Tarif und keine Bezahlschranke für Datei-Uploads oder lange Gespräche. Der einzige Nachteil ist die Fair-Use-Drosselung: In Stoßzeiten können „Server Busy"-Meldungen auftreten.
Für Entwickler enthält die API ein Kontingent von 5 Millionen Token für neue Anmeldungen, gültig für 30 Tage. Das reicht für 2.500 bis 5.000 Testaufrufe, je nach Prompt-Länge, und ist zum aktuellen V4 Flash-Tarif ungefähr $8.40 wert. Eine Kreditkarte ist nicht erforderlich, und nach dem Verbrauch wechselt die Abrechnung auf die oben genannten Standard-Pay-per-Token-Tarife.
DeepSeek-Preise bei OpenRouter, AWS Bedrock und Azure
Wer DeepSeeks eigene API nicht nutzen möchte, kann auf mehrere Drittanbieter zurückgreifen, die dieselben Modelle hosten. Die Preise variieren, da jede Plattform ihre eigene Marge, Infrastrukturkosten und Routing einbringt.
| Anbieter | Modell | Input/M | Output/M | Hinweise |
|---|---|---|---|---|
| OpenRouter | DeepSeek V4 Pro | $0.435 | $0.87 | Entspricht DeepSeeks direkten API-Preisen |
| OpenRouter | DeepSeek V4 Flash | $0.14 | $0.28 | Entspricht dem direkten API-Preis |
| OpenRouter | DeepSeek V3.2 | $0.252 | $0.378 | Legacy-Option im mittleren Segment |
| OpenRouter | DeepSeek R1 (Reasoning) | $0.70 | $2.50 | Ursprüngliches R1-Chain-of-Thought-Modell |
| AWS Bedrock | DeepSeek V3.2 | $0.62 | $1.85 | Teurer als direkt, aber unternehmensfreundlich |
| Azure AI Foundry | DeepSeek (verschiedene) | variiert | variiert | Preis je nach Region und SKU |
OpenRouter bietet zudem mehrere kostenlose destillierte DeepSeek-Modelle, darunter kleinere R1-Destillate und DeepSeek V3 Base, mit Rate-Limits aber ohne Token-Gebühren. Ideal zum Prototypen.
DeepSeek R1 vs. V3 Preise
Das ist eine der meistgestellten Fragen zu DeepSeek-Preisen. Die kurze Antwort: R1 reasont besser, kostet aber ungefähr fünfmal mehr pro Anfrage. Sobald es soweit ist, werden wir die DeepSeek R2-Preise aufschlüsseln, sobald die offiziellen Tarife bekannt sind.
| Modell | Input/M | Output/M | Am besten für |
|---|---|---|---|
DeepSeek V3 (Legacy deepseek-chat) | $0.27 | $1.10 | Allgemeiner Chat, Zusammenfassungen, Texte |
DeepSeek R1 (Legacy deepseek-reasoner) | $0.55 | $2.19 | Mathematik, Logik, mehrstufiges Reasoning |
| DeepSeek V4 Flash | $0.14 | $0.28 | Ersetzt V3, günstiger mit größerem Kontext |
| DeepSeek V4 Pro | $0.435 | $0.87 | Ersetzt R1, Frontier-Reasoning |
R1 generiert pro Anfrage deutlich mehr Output-Token, da es vor der eigentlichen Antwort eine Chain-of-Thought produziert. Das vergrößert den Preisunterschied in der Praxis. Mit V4 unterstützen sowohl Flash als auch Pro Thinking- und Non-Thinking-Modi, sodass du die Reasoning-Tiefe pro Aufruf wählen kannst. Mehr zum ursprünglichen Reasoner findest du in unserem ausführlichen Überblick zu DeepSeek-R1 und wie es OpenAI schlug.
Wie DeepSeek-Preise im Vergleich zu GPT-5.6, Claude und Gemini abschneiden
| Modell | Input/M | Output/M | DeepSeek V4 Flash Multiplikator |
|---|---|---|---|
| DeepSeek V4 Flash | $0.14 | $0.28 | 1x |
| DeepSeek V4 Pro | $0.435 | $0.87 | ~3x |
| GPT-5.6 Luna | $0.20 | $1.20 | 1,4x / 4,3x teurer |
| GPT-5.6 Terra | $2.00 | $12.00 | 14x / 43x teurer |
| Gemini 3.1 Pro | $2.00 (unter 200K Kontext) | $12.00 | 14x / 43x teurer |
| Claude Sonnet 5 | $2.00* | $10.00* | 14x / 36x teurer |
| GPT-5.6 Sol | $5.00 | $30.00 | 36x / 107x teurer |
| Claude Opus 5 | $5.00 | $25.00 | 36x / 89x teurer |
* Claude Sonnet 5 kostet $2/$10 zu einem Einführungspreis, der bis zum 31. August 2026 gilt, danach steigt er auf $3/$15. Auffällig: Das Ranking hängt stark vom Tier ab. Die Flaggschiff-Modelle sind beim Input noch 36-mal teurer, aber OpenAIs Preissenkung im Juli 2026 hat Luna auf $0.20 gesenkt, sodass der reine Token-Preis nicht mehr das alleinige Argument ist.
DeepSeek ist nicht immer das cleverste Modell im Benchmark, aber beim Preis pro nützlichem Token kommt nichts heran. Für hochvolumige Workloads wie Content-Pipelines, Zusammenfassungen, Klassifikation und RAG über große Datenmengen ist DeepSeek oft das einzige Modell, das die Stückkosten wirtschaftlich macht. Den vollständigen Vergleich einschließlich monatlicher Abonnement-Tiers findest du in unserem vollständigen KI-Preisvergleich. Und für einen direkten Vergleich zu Fähigkeiten, Genauigkeit und Stärken der einzelnen Modelle lies unseren DeepSeek vs. ChatGPT Vergleich.
DeepSeek API-Kosten optimieren
Ein paar schnelle Maßnahmen können eine DeepSeek-Rechnung um 50 bis 90 % senken.
- System-Prompt fixieren. Cache-Treffer sind bei V4 Flash 98 % günstiger. Denselben Eröffnungskontext für alle Anfragen verwenden.
- Standardmäßig V4 Flash wählen. Nur dann auf V4 Pro wechseln, wenn der Task wirklich Reasoning-Tiefe braucht.
- Output begrenzen. Du zahlst pro Output-Token, also
max_tokensauf den kleinsten noch sinnvollen Wert setzen. - Batch-Jobs außerhalb der Pekinger Bürozeiten planen. Wenn der 2-fache Spitzenaufschlag kommt, sind die teuren Zeitfenster 9:00 bis 12:00 und 14:00 bis 18:00 Pekinger Zeit (UTC+8). Schwere Jobs jetzt schon außerhalb dieser Fenster einzuplanen kostet nichts und halbiert die Rechnung, sobald der Aufschlag greift.
- Das 1M-Kontextfenster von V4 sinnvoll nutzen. Ein großes Kontextfenster kostet in DeepSeeks Preismodell keinen Aufpreis, also lieber mehr Retrieval-Ergebnisse hineinpacken, statt für wiederholte Runden zu bezahlen.
- Zuerst kostenlose OpenRouter-Destillate ausprobieren. Auf den kostenlosen R1-Destillaten prototypen, dann die Modell-ID beim Go-Live wechseln.
DeepSeek ohne API-Keys nutzen? Fello AI ausprobieren
Die meisten Leser wollen keinen Code gegen eine API schreiben. Sie wollen mit dem besten Modell für den jeweiligen Task chatten, ohne fünf Abonnements, fünf Browser-Tabs und fünf verschiedene Kontexte zu jonglieren.
Fello AI ist der einfachste Weg genau dafür. Ein Abonnement gibt dir DeepSeek, ChatGPT, Claude, Gemini, Grok, Perplexity und weitere Top-Modelle in einer einzigen App für Mac, iPhone und iPad für $9.99 pro Monat. Keine Token-Abrechnung zum Nachverfolgen, kein Nutzungslimit zum Einplanen, kein separater Account pro Anbieter. Alles in einem Chat-Fenster und einer Verlaufsansicht.
Warum Fello AI für DeepSeek-Nutzer so gut passt
DeepSeek ist das günstigste seriöse Modell in der API, aber der offizielle Web-Chat ist gedrosselt und das Desktop-Erlebnis spartanisch. Fello AI löst beides. Du bekommst DeepSeek in einer echten Mac-nativen App mit Prompt-Verlauf, Datei-Uploads, Bildanalyse, Spracheingabe und der Möglichkeit, Modelle mitten im Gespräch zu wechseln, wenn DeepSeek für die nächste Nachricht nicht das richtige Werkzeug ist. Wenn dein Prompt besser von Claudes Schreibfähigkeit oder GPTs Reasoning beantwortet würde, Modell wechseln ohne Kontextverlust.
Was sparst du wirklich?
Die Standard-Abonnementkosten der wichtigsten Modelle addieren sich: ChatGPT Plus für $20/Monat, Claude Pro für $20/Monat, Gemini Advanced für $20/Monat, Perplexity Pro für $20/Monat und Grok für $30/Monat. Das sind rund $110 pro Monat für Einzelzugänge. Fello AI fasst dasselbe Angebot für $9.99 pro Monat zusammen, DeepSeek inklusive. Mit 25.000+ Fünf-Sterne-Bewertungen im App Store und Mac App Store ist es die beliebteste KI-Bundle-App im Apple-Ökosystem.
Wer DeepSeek lieber getrennt von den anderen nutzen möchte, findet bei uns auch einen Leitfaden zu einem dedizierten DeepSeek Desktop-Client für Mac.
Fazit
DeepSeek-Preise 2026 sind die günstigsten an der Frontier. V4 Flash für $0.14/$0.28 pro Million Token schlägt jeden westlichen Anbieter in der Kostenfrage um Größenordnungen. V4 Pro, jetzt dauerhaft 75 % günstiger bei $0.435/$0.87, erlaubt den Einsatz eines Top-Reasoning-Modells für unter einen Dollar pro Million Output-Token. Der Web-Chat bleibt kostenlos, die API vergibt 5 Millionen freie Token und Prompt-Caching senkt die Kosten für wiederholte Eingaben obendrauf um rund 98 %.
Wer Software entwickelt, besucht direkt die offizielle DeepSeek-Preisseite und startet mit V4 Flash. Wer DeepSeek neben ChatGPT, Claude und Gemini an einem Ort nutzen möchte, wählt Fello AI als einfachsten Weg.
FAQ
Ist DeepSeek kostenlos?
Ja, für Einzelnutzer. Der Web-Chat unter chat.deepseek.com und die offizielle mobile App sind kostenlos ohne Plus- oder Pro-Tarif. Die API gibt jedem neuen Account außerdem ein Guthaben von 5 Millionen Token, bevor die Abrechnung beginnt.
Wie viel kostet die DeepSeek API pro Million Token?
DeepSeek V4 Flash kostet $0.14 pro Million Input-Token (Cache-Miss) und $0.28 pro Million Output-Token. V4 Pro kostet $0.435 im Input und $0.87 im Output, nach einer dauerhaften Preissenkung um 75 %.
Was ist der Unterschied zwischen V4 Flash und V4 Pro in der Preisgestaltung?
V4 Flash ist das günstige Arbeitspferd für $0.14/$0.28 pro Million Token. V4 Pro ist das Flagship-Reasoning-Modell und kostet ungefähr dreimal so viel, nämlich $0.435/$0.87 pro Million Token.
Ist DeepSeek günstiger als ChatGPT oder Claude?
Das hängt davon ab, welche Tiers verglichen werden. Gegen Flaggschiffe wie GPT-5.6 Sol ($5/$30) oder Claude Opus 5 ($5/$25) ist V4 Flash beim Input 36-mal günstiger. Gegen OpenAIs günstigstes Tier, GPT-5.6 Luna für $0.20/$1.20 seit der Preissenkung im Juli 2026, schrumpft der Abstand auf 1,4-fach beim Input und 4,3-fach beim Output. DeepSeek ist überall günstiger, nur nicht mehr in dem Ausmaß wie früher.
Was kosten DeepSeek-Modelle bei OpenRouter?
OpenRouter spiegelt DeepSeeks direkte Tarife für V4 Flash und V4 Pro und bietet zusätzlich mehrere kostenlose destillierte Modelle zum Prototypen mit Rate-Limits, aber ohne Token-Gebühren.
Berechnet DeepSeek extra für das 1-Million-Token-Kontextfenster?
Nein. Der volle 1M-Kontext ist im Standard-Token-Tarif von V4 Flash und V4 Pro enthalten.