Kimi ist kostenlos nutzbar, und das ist die kürzeste Zusammenfassung der Preisgestaltung von Moonshot AI. Die Kimi App bietet unbegrenzten Basis-Chat, Datei-Uploads und Websuche im $0 Adagio-Plan, während bezahlte Mitgliedschaften von $19 im Monat bis $199 im Monat für intensive Agenten- und Coding-Nutzung reichen. Wer stattdessen auf die API setzt, zahlt pro Token, wobei das Flaggschiffmodell Kimi K3 bei $3 pro Million Input-Token und $15 pro Million Output-Token liegt.
Genau die Lücke zwischen kostenloser Chat-App und abgerechnetem Entwickler-API ist das eigentliche Thema bei den Kimi-Preisen, und sie verwirrt viele Käufer. Dieser Leitfaden erklärt jedes Abo-Tier, die vollständige API-Preisliste pro Modell, die tatsächlichen Grenzen des kostenlosen Plans und wie die Kosten von Kimi im Vergleich zu Claude, GPT und DeepSeek aussehen. Alle API-Preise wurden am 25. September 2026 erneut mit Moonshots eigener Entwicklerdokumentation abgeglichen, die App-Pläne sind die internationalen Preise, die Kimi in US-Dollar verlangt.
Die wichtigsten Punkte
- Dauerhaft kostenloser Plan: Der Adagio-Plan kostet $0 mit unbegrenztem Basis-Chat, aber nur etwa 6 Agenten-Credits ohne Agent Swarm oder Kimi Code.
- App-Pläne: Bezahlte Mitgliedschaften kosten $19 (Moderato), $39 (Allegretto), $99 (Allegro) und $199 (Vivace) pro Monat.
- Flaggschiff-API: Kimi K3 kostet $3 / $15 pro Million Input-/Output-Token, mit einem Cache-Treffer-Eingabepreis von nur $0.30.
- Günstige API: Kimi K2.6 kostet $0.95 / $4 pro Million Token, also etwas mehr als ein Viertel des Output-Preises von K3.
- Günstiger als westliche Flaggschiffe, aber nicht als alles: K3 unterbietet Claude Opus 5.5 ($4 / $20) und GPT-6 Astra ($10 / $50), doch OpenAIs GPT-6 Sol kostet jetzt weniger, $2 / $10, und schneidet besser ab.
Was kostet Kimi? Die kurze Antwort
Kimi ist kostenlos ausprobierbar. Die Kimi App ist im Adagio-Tier kostenlos, und bezahlte Pläne reichen von $19 im Monat bis $199 im Monat, je nachdem wie viel Agenten- und Coding-Arbeit du brauchst. Über die Moonshot-API zahlst du pro Token statt einer Pauschale, wobei das Flaggschiff Kimi K3 bei $3 pro Million Input und $15 pro Million Output-Token liegt, während das günstigere K2.6-Modell bei $0.95 / $4 liegt.
Welcher Wert relevant ist, hängt von der Nutzungsweise ab. Gelegenheitsnutzer, die chatten, Dokumente hochladen und im Web suchen, kommen meist mit dem kostenlosen oder $19-Plan aus. Entwickler, die Kimi in eine App, einen Agenten oder ein Coding-Tool einbauen, interessiert der Token-Preis, denn er skaliert mit der Nutzung. Der Rest dieses Leitfadens deckt beide Seiten vollständig ab.
Kimi-Abopläne und Mitgliedschaftspreise
Moonshot benennt Kimis fünf Mitgliedschaftsstufen nach musikalischen Tempoangaben, vom langsamen kostenlosen Adagio-Plan bis zum schnellen, funktionsreichen Vivace-Tier. Jeder bezahlte Plan ist monatlich oder jährlich auf Moonshots offizieller Mitgliedschaftsseite verfügbar, und die Jahresoption spart etwa 20 % gegenüber dem Monatspreis. Die jährliche Abrechnung beim Top-Plan spart bis zu $480 im Jahr. Ein Vorbehalt, bevor du planst: Am 19. Juli 2026 hat Moonshot neue Abos pausiert, weil die Nachfrage nach K3 seine GPUs an die Kapazitätsgrenze gebracht hatte, und angekündigt, Plätze schrittweise wieder freizugeben. Ein Tarif ist für Neukunden also womöglich gerade nicht offen.
| Plan | Monatlich | Jährlich | Geeignet für |
|---|---|---|---|
| Adagio | Kostenlos | Kostenlos | Gelegentlichen Chat und Tests |
| Moderato | $19 | $180/Jahr | Einzelnutzer, leichte Agenten-Nutzung |
| Allegretto | $39 | $372/Jahr | Power-User, mehr Coding |
| Allegro | $99 | $948/Jahr | Intensive Agenten-Nutzung und Kimi Code |
| Vivace | $199 | $1,908/Jahr | Teams, maximale Parallelität |
Adagio (Kostenlos)
Der kostenlose Plan bietet unbegrenzten Basis-Chat, Datei-Uploads und Live-Webzugriff, was die meisten alltäglichen Fragen abdeckt. Er enthält etwa 6 Agenten-Credits, eine einzige parallele Aufgabe und 200 professionelle Datenbankaufrufe. Agent Swarm, Kimi Code und Kimi Claw sind gesperrt, sodass ernsthafte Automatisierung erst nach einem Upgrade möglich ist.
Moderato ($19/Monat)
Das günstigste bezahlte Tier ist der optimale Einstieg für Einzelnutzer, die echte Agenten-Arbeit wollen. Du erhältst 60 Agenten-Credits, zwei parallele Aufgaben, 4-fache Agenten-Geschwindigkeit als Priorität und 25 Agent Swarm-Läufe in der Beta. Außerdem kommt Kimi Code mit 1x dazu, und die Datenbankaufrufe steigen auf 2.000.
Allegretto ($39/Monat)
Allegretto richtet sich an Power-User, die Kimi intensiv fürs Coding nutzen. Es bietet 150 Agenten-Credits, 50 Agent Swarm-Läufe mit vier parallelen Teilaufgaben und Kimi Code mit 5x. Außerdem ist dies das erste Tier, das Kimi Claw enthält, den Browser-Steuerungs-Agenten.
Allegro ($99/Monat)
Allegro ist der Plan für intensive Workloads, mit 360 Agenten-Credits, vier parallelen Aufgaben und 120 Agent Swarm-Läufen. Kimi Code springt auf 15x und Datenbankaufrufe erreichen 12.000. Die meisten unabhängigen Entwickler, die täglich Agenten betreiben, werden mehr als das nicht benötigen.
Vivace ($199/Monat)
Vivace ist das Top-Tier, gebaut für Teams und ununterbrochene Automatisierung. Es liefert 720 Agenten-Credits, 240 Agent Swarm-Läufe mit acht parallelen Teilaufgaben und Kimi Code mit 30x. Bei $199 im Monat liegt es deutlich unter dem, was vergleichbare Enterprise-KI-Sitze anderswo kosten, was ein wesentlicher Teil von Kimis Attraktivität ist.
Ist Kimi kostenlos? Was das Adagio-Tier wirklich bietet
Ja, Kimi ist kostenlos nutzbar, und das hat sich 2026 nicht geändert. Das kostenlose Adagio-Tier bietet weiterhin unbegrenzten Standard-Chat, Dokument-Uploads und Web-Browsing, betrieben von einem leistungsfähigen Modell statt eines abgespeckten. Fürs Fragen stellen, Dateien zusammenfassen und allgemeine Recherchen musst du möglicherweise nie einen Cent zahlen.
Der Haken liegt bei der Agenten-Arbeit. Moonshot hat das kostenlose Tier so eingeschränkt, dass autonome mehrstufige Aufgaben, Agent Swarm und Kimi Code hinter bezahlten Plänen versteckt sind. Du erhältst pro Zeitraum nur eine Handvoll Agenten-Credits im Adagio, was für einen kurzen Test ausreicht, aber nicht zum Bauen. Wer Kimi lange Rechercheaufgaben erledigen, einen Browser steuern oder Code schreiben und ausführen lassen will, braucht den $19 Moderato-Plan als echten Startpunkt. Die vollständige Modellübersicht findest du in unserem Leitfaden zum Kimi K2.6-Modell.
Kimi-API-Preise pro Million Token
Als Entwickler wird die Moonshot-API für dich der interessanteste Teil der Kimi-Preise. Du zahlst nur für die Token, die du sendest und empfängst, abgerechnet pro Million, wobei die Preise je nach Modell stark variieren. Das neueste und leistungsfähigste Modell kostet am meisten, während die Vorgänger-Modelle deutlich günstiger bleiben. Prompt-Caching kann deine Input-Kosten drastisch senken, wenn du denselben Kontext wiederverwendest.
| Modell | Input /1M | Output /1M | Cache-Treffer | Kontext |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | $0.30 | 1M |
| Kimi K2.7 Code | $0.95 | $4.00 | $0.19 | 262K |
| Kimi K2.7 Code HighSpeed | $1.90 | $8.00 | $0.38 | 262K |
| Kimi K2.6 | $0.95 | $4.00 | $0.16 | 262K |
Kimi K3-Preise
Das Flaggschiff Kimi K3 ist ein Modell mit 2,8 Billionen Parametern, das 104 Milliarden Parameter pro Token aktiviert, mit einem 1-Millionen-Token-Kontextfenster, und entsprechend bei $3 Input und $15 Output pro Million Token bepreist ist. Die bemerkenswerteste Zahl ist der Cache-Treffer-Eingabepreis von nur $0.30, einem Zehntel des Nicht-Treffer-Preises, was Workloads belohnt, die lange System-Prompts oder Dokumente wiederverwenden. Vollständige Spezifikationen und Benchmarks gibt es in unserem Kimi K3-Deepdive.
Kimi K2.7 Code und K2.6-Preise
Sowohl K2.7 Code als auch K2.6 kosten $0.95 Input und $4 Output pro Million Token, was sie zu den Preis-Leistungs-Allroundern der Reihe macht. Beide veröffentlichen einen Cache-Treffer-Preis, $0.19 für K2.7 Code und $0.16 für K2.6, und K2.7 Code ist auf langfristiges Coding und Multi-Agenten-Orchestrierung ausgelegt. Wenn dir Tempo wichtiger ist als der Preis, verdoppelt K2.7 Code HighSpeed alle Preise auf $1.90 / $8, bei einem Output, den Moonshot mit etwa 180 Token pro Sekunde angibt. Für die meisten Produktions-Apps, die kein volles Millionen-Token-Kontextfenster brauchen, sind K2.6 oder K2.7 Code die clevere Standardwahl.
Kimi K2.5 und K2 sind eingestellt
Wenn dich ein älterer Ratgeber zu K2.5 für $0.60 / $3 oder zum ursprünglichen Kimi K2 für $0.60 / $2.50 schickt: Beide lassen sich nicht mehr buchen. Moonshot hat die kimi-k2-Reihe am 25. Mai 2026 und kimi-k2.5 am 31. August 2026 eingestellt, und Aufrufe von K2.5 liefern laut der Modellliste jetzt einen 404-Fehler „model not found“. Moonshot verweist K2.5-Nutzer auf K3, preislich ist aber K2.6 für $0.95 / $4 der nächste Ersatz, und der kostet mehr als jedes der beiden eingestellten Modelle.
Ein zusätzlicher Kostenpunkt sind Tools. Websuche wird pro Aufruf zusätzlich zur Token-Nutzung abgerechnet. Im September 2026 hat Moonshot sie auf eigenständige Endpunkte verlegt, mit $0.002 pro Web-Search-Basic-Aufruf, $0.003 pro Web-Search-Pro-Aufruf und $0.002 pro URL-Abruf, berechnet nur, wenn ein Aufruf Ergebnisse liefert. Das ältere integrierte Websuche-Tool kostet weiterhin $0.005 pro Aufruf, und seine Ergebnisse zählen bei deiner nächsten Anfrage als Input-Token. Moonshot veröffentlicht diese Gebühren in seiner Preisdokumentation zur Websuche. Pro Aufruf sind sie gering, summieren sich aber bei großem Volumen.
Was kostet Kimi wirklich? Ein konkretes Beispiel
Preise pro Million Token sind abstrakt, daher ein konkretes Beispiel. Angenommen, du sendest 1 Million Input-Token und erzeugst 1 Million Output-Token, also eine große Aufgabe, ungefähr ein Buch an Text in jede Richtung. Auf Kimi K3 kostet das $3 plus $15, also $18 gesamt vor jeglichem Caching. Dieselbe Aufgabe auf K2.6 fällt auf $0.95 plus $4, also nur $4.95.
Caching verändert die Rechnung erneut. Wenn der Großteil des Inputs aus einem wiederholten Dokument oder System-Prompt besteht, berechnet K3 den gecachten Teil mit $0.30 pro Million statt $3, und die Gesamtkosten sinken auf nahezu $15. Auch das Schreiben in den Cache kostet, $3 pro Million für den standardmäßigen Fünf-Minuten-Cache oder $6 für einen Ein-Stunden-Cache, daher lohnt sich Caching, wenn derselbe Präfix oft gelesen wird. Bei echten Chat-Apps mit kurzen Inputs und moderaten Outputs kosten die meisten Anfragen Bruchteile eines Cents. Die Erkenntnis ist einfach: Nimm K3, wenn du sein Reasoning und den Kontext brauchst, und wechsle zu K2.6, wenn nicht. Unser Leitfaden welches KI-Modell wann erklärt diese Abwägungen.
Kimi-Preise bei OpenRouter, Groq und anderen Anbietern
Moonshot ist nicht die einzige Bezugsquelle für Kimi-Token. Drittanbieter für Inferenz verkaufen die Open-Weight-Modelle weiter, manchmal unter Moonshots eigenem Listenpreis, und ergänzen Funktionen wie einheitliche Abrechnung und schnellere Hardware. Auf OpenRouter verlangten am 25. September 2026 sieben der 19 K3-Angebote Moonshots eigene $3 / $15, zehn lagen darunter, von DeepInfra mit $2.85 / $14.25 bis zu etwa $0.88 / $10.53 beim günstigsten Vier-Bit-Angebot. K2.6 beginnt beim günstigsten Wiederverkäufer bei etwa $0.45 / $1.90.
Groq, die übliche Wahl für schnelle Inferenz, bietet Kimi gar nicht mehr an. Der Anbieter hat sein letztes Kimi-K2-Modell abgeschaltet (Stichtag 15. April 2026) und verweist auf GPT-OSS 120B, für Tempo bei Kimi selbst führt der Weg jetzt über Moonshots K2.7 Code HighSpeed. Für Jobs, die warten können, spart Moonshots Batch API, seit April 2026 für alle Nutzer offen, 40 % gegenüber Echtzeit-Aufrufen. Wenn Durchsatz und Latenz wichtiger sind als der niedrigste Listenpreis, vergleiche die Anbieter, bevor du dich festlegst.
Kimi-Kosten im Vergleich zu Claude, GPT und DeepSeek
Kimis Versprechen war schon immer Output auf Frontier-Niveau zu einem Bruchteil westlicher Preise, und gegenüber den westlichen Flaggschiffen gilt das weiterhin. K3 ist bei Input und Output 25 % günstiger als Claude Opus 5.5 ($4 / $20) und 70 % günstiger als GPT-6 Astra ($10 / $50). Günstiger als alles aus dem Westen ist es aber nicht mehr. GPT-6 Sol, OpenAIs Mittelklassemodell, kostet $2 / $10, ein Drittel weniger als K3, und dasselbe gilt für Anthropics Claude Sonnet 5. DeepSeek, der andere chinesische Preisführer, bleibt deutlich günstiger, sein Preis verdoppelt sich aber werktags zu Spitzenzeiten (01:00 bis 04:00 und 06:00 bis 10:00 UTC). Alibabas Qwen 3.8 ist das andere chinesische Modell mit mehreren Billionen Parametern, das um dieselbe Preis-Leistungs-Krone kämpft. Wie sich dieser Abstand in den Chat-Apps selbst auswirkt, zeigt unser Vergleich Kimi vs ChatGPT.
| Modell | Input /1M | Output /1M | Hinweise |
|---|---|---|---|
| Kimi K3 | $3.00 | $15.00 | Flaggschiff, 1M Kontext |
| Kimi K2.6 | $0.95 | $4.00 | Günstiger Allrounder |
| Claude Fable 5.1 | $10.00 | $50.00 | Anthropics teuerstes Modell |
| Claude Opus 5.5 | $4.00 | $20.00 | Anthropic-Flaggschiff, führt den AA Intelligence Index an |
| GPT-6 Astra | $10.00 | $50.00 | OpenAI-Flaggschiff |
| GPT-6 Sol | $2.00 | $10.00 | OpenAI-Mittelklasse, günstiger als K3 |
| DeepSeek V4 Pro | $0.66 (Spitze $1.32) | $1.98 (Spitze $3.96) | Am günstigsten, zu Spitzenzeiten doppelt |
Der ehrliche Vorbehalt ist die Leistung, und sie spricht jetzt auch beim Preis-Leistungs-Verhältnis gegen K3. Im Artificial Analysis Intelligence Index (v4.3.2, maximaler Aufwand, abgerufen am 25. September 2026) erreicht K3 43,6, gegenüber 57,6 für Claude Opus 5.5, 52,7 für GPT-6 Astra und 47,5 für GPT-6 Sol. Unter den Open-Weight-Modellen liegt es auf Platz drei, hinter Xiaomis MiMo-V2.6-Pro (46,3) und GLM-5.3 (44,8). K3 ist also weder das stärkste Modell noch das beste Preis-Leistungs-Angebot an der Spitze, denn GPT-6 Sol schneidet für weniger Geld besser ab. Was K3 weiterhin bietet, sind offene Gewichte, ein Kontext von 1 Million Token und ein Preis deutlich unter Opus 5.5 und Astra. Für einen günstigeren, fähigen Coder sind K2.6 oder DeepSeek womöglich die bessere Wahl, wie in unserem Überblick zur besten KI fürs Programmieren beschrieben.
Kimi kostenlos durch Self-Hosting betreiben?
Hier wird Kimi für kostenbewusste Teams interessant. Moonshot veröffentlicht seine Modelle als offene Gewichte, und K3's Gewichte erschienen am 27. Juli 2026, sodass du es heute herunterladen und ohne jegliche Token-Gebühren betreiben kannst. Der Haken ist die Hardware. Das veröffentlichte Repository besteht aus 96 Safetensors-Shards mit insgesamt etwa 1,56 TB, und es wird bereits mit etwa vier Bit pro Parameter geliefert, sodass kein weiterer Quantisierungs-Trick wartet, um es auf eine Desktop-Karte zu schrumpfen.
Für die meisten Menschen lohnt sich Self-Hosting nur bei sehr hohem Volumen, wo die fixen Hardwarekosten eine abgerechnete API-Rechnung übersteigen. Kleinere Teams fahren in der Regel besser mit der gehosteten API oder einem Abo. Jedes aktuelle Kimi-Modell ist jetzt herunterladbar, K3 eingeschlossen, weshalb Kimi so hoch unter den besten Open-Source-KI-Modellen für alle rangiert, die volle Kontrolle und null Nutzungsgebühren wollen. Beachte, dass K3 unter Moonshots eigener Kimi K3 License erscheint und nicht unter den permissiven MIT-Bedingungen, die die früheren K2-Releases trugen.
Welchen Kimi-Plan solltest du wählen?
Wähle den Plan passend zur Aufgabe. Wenn du nur einen smarten Chatbot für Fragen, Dateien und Websuche willst, reicht das kostenlose Adagio-Tier. Willst du, dass Kimi Agenten ausführt, browst und codeiert, beginne mit $19 Moderato und steige nur höher, wenn du an seine Grenzen stößt. Entwickler, die Produkte bauen, sollten die App ganz überspringen und die API nutzen, K3 für schwieriges Reasoning und K2.6 für alles andere.
Wenn du lieber kein Moonshot-Abo verwalten willst, lässt dich eine Multi-Modell-App wie Fello AI Kimi-Modelle neben anderen Frontier-Modellen wie ChatGPT, Gemini, Grok, Deepseek und mehr nutzen, was praktisch ist, wenn du Ergebnisse vergleichen willst. Dank Fello AI zahlst du nur $9.99 im Monat und kannst mehrere Modelle gleichzeitig nutzen. Auf dem Mac kommt es als nativer Kimi-Desktop-Client an, ohne ein Moonshot-Konto, das du aufladen musst. Egal für welchen Weg du dich entscheidest, Kimi bleibt eine der aggressivsten Frontier-Optionen auf dem Markt, und das kostenlose Tier macht das Ausprobieren kostenlos.
FAQ
Ist Kimi kostenlos nutzbar?
Ja. Das kostenlose Adagio-Tier bietet unbegrenzten Basis-Chat, Datei-Uploads und Webzugriff kostenlos. Es ist auf etwa 6 Agenten-Credits begrenzt und schließt Agent Swarm, Kimi Code und Kimi Claw aus, sodass intensive Agenten- und Coding-Arbeit einen bezahlten Plan ab $19 im Monat erfordert.
Wie viel kostet die Kimi-API pro Million Token?
Das hängt vom Modell ab. Das Flaggschiff Kimi K3 kostet $3 pro Million Input-Token und $15 pro Million Output-Token. Die günstigeren Modelle K2.6 und K2.7 Code kosten $0.95 / $4, K2.7 Code HighSpeed kostet $1.90 / $8. Cache-Treffer senken die Input-Kosten um etwa 80 bis 90 Prozent, und die Batch API spart 40 Prozent bei Jobs, die warten können.
Was sind die Kimi K3-Preise?
Kimi K3 kostet $3 pro Million Input-Token und $15 pro Million Output-Token, mit einem Cache-Treffer-Eingabepreis von nur $0.30. Es verfügt über ein 1-Millionen-Token-Kontextfenster, sodass eine große Aufgabe mit 1M Input und 1M Output etwa $18 vor Caching kostet.
Ist Kimi günstiger als Claude und GPT?
Günstiger als deren Flaggschiffe, ja. Kimi K3 für $3 / $15 unterbietet Claude Opus 5.5 ($4 / $20) und GPT-6 Astra ($10 / $50) bei Input und Output. Günstiger als GPT-6 Sol oder Claude Sonnet 5, die beide $2 / $10 kosten, ist es nicht, und GPT-6 Sol schneidet im Artificial Analysis Intelligence Index auch besser ab als K3 (47,5 gegenüber 43,6). DeepSeek V4 Pro ist mit $0.66 / $1.98 außerhalb der Spitzenzeiten günstiger als alle.
Kann ich Kimi kostenlos durch Self-Hosting betreiben?
Ja. Moonshot veröffentlicht seine Modelle als offene Gewichte, und K3's Gewichte erschienen am 27. Juli 2026, sodass du es lokal ohne Token-Gebühren betreiben kannst. Die praktische Hürde ist die Größe, denn das K3-Repository umfasst etwa 1,56 TB auf 96 Shards. Self-Hosting lohnt sich nur bei hohem Volumen, und für die meisten Teams bleibt die gehostete API günstiger.