Die Qwen-Preisgestaltung teilt sich in zwei sehr unterschiedliche Wege, und die meisten Menschen brauchen nur den kostenlosen. Die Qwen Chat App ist vollständig kostenlos ohne Abo, während Entwickler über die API pro Token zahlen, wo die Preise von $0.05 pro Million Eingabe-Token beim günstigsten Modell bis zu $6.00 pro Million Ausgabe-Token beim Flaggschiffmodell Qwen3.8-Max reichen. Dieser 120-fache Unterschied zwischen dem günstigsten und dem Flaggschiff-Preis ist das Wichtigste, das du verstehen solltest, bevor du ein Modell auswählen.
Dieser Leitfaden erklärt alle Teile der Qwen-Preise für 2026: die kostenlose Qwen Chat App, die Pay-as-you-go-API-Preise für jedes Modell, die Eingabegroesstierungen, die manche Preise still erhöhen, den kostenlosen Token-Test für neue Entwickler und wie Qwen bei den Kosten gegen DeepSeek und Claude abschneidet. Wir behandeln auch die Änderung, die viele Entwickler kalt erwischt hat: das Ende des kostenlosen API-Tarifs am 15. April 2026, und wo Qwen noch den besten Gegenwert bietet.
Das Wichtigste im Überblick
- Qwen Chat ist kostenlos, ohne Consumer-Abo wie ChatGPT Plus oder Claude Pro.
- API-Preise reichen von $0.05 / $0.40 pro Million Token (Qwen-Flash) bis $2.00 / $6.00 beim Flaggschiffmodell Qwen3.8-Max, allgemein verfügbar seit dem 3. August 2026. Das vorherige Flaggschiff Qwen3.7-Max ist mit $1.25 / $3.75 auf einer 50%-Aktion (Listenpreis $2.50 / $7.50) noch günstiger.
- Das Mid-Tier-Modell Qwen-Plus beginnt bei $0.40 / $1.20 pro Million Token und ist die beste Balance aus Preis und Leistung für die meisten Apps.
- Mehrere Qwen-Modelle sind nach Eingabegröße gestaffelt, der Schlagzeilen-Preis ist also ein „ab"-Preis, der bei langen Prompts steigt (Qwen3-Max läuft von $1.20 bis $3.00 Eingabe über sein 262K-Kontextfenster). Qwen3.8-Max ist die Ausnahme: Es berechnet einen einzigen Pauschalpreis über sein gesamtes 1M-Fenster.
- Der kostenlose Entwickler-API-Tarif endete am 15. April 2026 und wurde durch einen einmaligen Test von 1 Million Token pro Modell (insgesamt rund 70 Millionen) für neue Konten ersetzt.
Qwen-Preise auf einen Blick
Qwen ist Alibabas Familie von KI-Modellen, und du kannst es auf zwei Arten nutzen. Die Consumer-Qwen Chat App auf chat.qwen.ai ist kostenlos, und die Entwickler-API wird pro Token über Alibaba Cloud Model Studio abgerechnet (die Plattform, die früher als DashScope bekannt war). Es gibt keinen flachen monatlichen Consumer-Plan dazwischen, was Qwen gegenüber westlichen Konkurrenten ungewöhnlich macht. Qwens offene Basismodelle bekaeftigen auch Drittanbieter-Fine-Tunes, darunter Rio 3.5 Open 397B der Stadtverwaltung von Rio de Janeiro.
Hier sind die Kosten der wichtigsten Textmodelle auf der API, Preis pro Million Token. Eingabe ist, was du für den Text zahlst, den du schickst, und Ausgabe ist, was du für den Text zahlst, den das Modell zurückgibt.
| Modell | Eingabe ($/1M) | Ausgabe ($/1M) | Kontextfenster | Am besten für |
|---|---|---|---|---|
| Qwen-Flash | ab $0.05 | ab $0.40 | 1M Token | Volumenstarke, einfache Aufgaben |
| Qwen-Plus | ab $0.40 | ab $1.20 | 1M Token | Das Alltagsarbeitspferd |
| Qwen3.7-Plus | ab $0.32 | ab $1.28 | 1M Token | Multimodale Apps |
| Qwen3-Max | ab $1.20 | ab $6.00 | 262K Token | Schweres Reasoning, Coding |
| Qwen3.7-Max | $1.25 | $3.75 | 1M Token | Vorheriges Flaggschiff, günstigste Aktion |
| Qwen3.8-Max | $2.00 | $6.00 | 1M Token | Flaggschiff, Pauschalpreis bei beliebiger Länge |
Qwen3.8-Max übernahm den Flaggschiff-Platz am 3. August 2026 zum Pauschalpreis von $2.00 / $6.00. Sein Vorgänger Qwen3.7-Max bleibt im Preiskatalog zu $1.25 / $3.75, einem 50-prozentigen Aktionsrabatt auf den Listenpreis von $2.50 / $7.50. Lies beide Zeilen zusammen: Solange die Aktion läuft, ist das ältere Modell das günstigere; sobald sie endet, ist es das teurere. Alibaba hat kein Enddatum für diesen Rabatt angekündigt, also budgetiere bei langfristigen Projekten mit Listenpreisen.
Ein Hinweis zum Lesen dieser Zahlen: Model Studio staffelt mehrere Preise nach der Eingabegröße jeder Anfrage, die oben genannten „ab"-Preise sind also die Einstiegsstaffeln, und deine Kosten steigen bei längeren Prompts. Bestätigung die aktuellen Preise für dein Modell und deine Region immer in den Alibaba Cloud Model Studio Preisdokumenten, bevor du ein Budget erstellst.
Ist Qwen kostenlos?
Ja. Die Qwen Chat App auf chat.qwen.ai ist kostenlos ohne Abo, ähnlich wie die Gratisversion von ChatGPT oder Gemini. Du bekommst Zugang zu Qwens starken Modellen für alltägliches Chatten, Schreiben, Coding-Hilfe und Bildaufgaben, ohne irgendetwas zu zahlen, und Alibaba hat klare kommerzielle Gründe, die Consumer-App kostenlos zu halten.
Bezahlte Preise kommen erst ins Spiel, wenn du auf der Qwen API über Alibaba Cloud Model Studio entwickelst, die pro Token abrechnet. Wenn du also einfach mit Qwen chatten möchtest, zahlst du nichts. Wenn du Qwen in dein eigenes Produkt einbinden möchtest, zahlst du nach Nutzung.
Qwen-API-Preise nach Modell
Im Folgenden haben wir die API-Preise für jedes Qwen-Modell aufgeschlüsselt, damit du das richtige Tier für deine Arbeitslast und dein Budget findest.
Qwen-Flash und Qwen-Turbo: ab $0.05 / $0.40
Qwen-Flash ist das Budget-Tier bei ab $0.05 Eingabe / $0.40 Ausgabe pro Million Token für Prompts bis 256K, steigt auf $0.25 / $2.00 bei längeren Eingaben. Es ist auf Geschwindigkeit und hohe Volumen ausgelegt und eignet sich für Klassifizierung, einfache Frage-und-Antwort, Tagging und alle Aufgaben, bei denen du viele Anfragen sendest und kein Flaggschiff-Reasoning benötigst. Qwen-Flash ersetzt jetzt das ältere Qwen-Turbo, das Alibaba als nicht mehr aktualisiert markiert hat, also sollten neue Projekte standardmäßig Flash verwenden. Zu diesen Preisen kannst du Millionen von Token für ein paar Dollar verarbeiten.
Qwen-Plus: ab $0.40 / $1.20
Qwen-Plus liegt in der Mitte bei ab $0.40 Eingabe / $1.20 Ausgabe pro Million Token und ist das Modell, mit dem die meisten Apps beginnen sollten. Es ist nach Promptlänge gestaffelt, der Preis steigt also auf $1.20 Eingabe / $3.60 Ausgabe, sobald eine einzelne Anfrage 256K Token übersteigt, und der Thinking-Modus erhoht die Ausgabe weiter. Es bewältigt den Großteil der echten Arbeit, Zusammenfassen, Entwerfen, Coding-Unterstützung und Retrieval-Aufgaben, zu einem Preis, der im großen Massstab vernünftig bleibt.
Qwen3.7-Plus: ab $0.32 / $1.28
Qwen3.7-Plus ist Qwens multimodales Mid-Tier-Modell, das Text-, Bild- und Videoeingaben akzeptiert. Es läuft bei ab $0.32 Eingabe / $1.28 Ausgabe pro Million Token, ein Rabatt von 20 % auf den Listenpreis von $0.40 / $1.60, und wie Qwen-Plus wird es bei langem Kontext nach oben gestaffelt. Wenn du Apps entwickelst, die Bilder oder Video mit Text mischen, und günstig bleiben möchtest, solltest du dieses Tier testen, bevor du zu einem Max-Modell wechselst.
Qwen3-Max: ab $1.20 / $6.00
Qwen3-Max ist das leistungsstarke Reasoning-Modell, Preis ab $1.20 Eingabe / $6.00 Ausgabe pro Million Token für Prompts bis 32K. Die Kosten steigen in Staffeln: $2.40 / $12 von 32K bis 128K und $3.00 / $15 bis zum Limit, sodass Long-Context-Jobs deutlich mehr kosten, als der Schlagzeilen-Preis vermuten lässt. Beachte, dass Qwen3-Max bei 262K Token Kontext endet und nicht die vollen 1M erreicht, die kleinere Qwen-Modelle bieten.
Qwen3.8-Max: $2.00 / $6.00 (Flaggschiff)
Qwen3.8-Max wurde am 3. August 2026 allgemein verfügbar und steht an der Spitze des Angebots: ein 2,4-Billionen-Parameter-Mixture-of-Experts-Modell, das pro Token rund 95 Milliarden Parameter aktiviert. Es akzeptiert Text-, Bild- und Videoeingaben, gibt bis zu 128K Ausgabe-Token zurück und kostet $2.00 Eingabe / $6.00 Ausgabe pro Million Token. Anders als alle anderen Modelle auf dieser Seite ist dieser Preis über das gesamte 1M-Token-Kontextfenster pauschal. 5.000 oder 900.000 Token, der Preis pro Token ändert sich nicht, was die Eingabegroessklippe eliminiert, die Qwen3-Max- und Qwen-Plus-Rechnungen schwer vorhersagbar macht.
Die Ersparnis steckt im Caching. Implizites Caching von Eingaben kostet $0.25 pro Million, explizite Cache-Lesevorgänge fallen auf $0.17, und das Schreiben in einen expliziten Cache kostet $2.50. Zu diesen Preisen kostet ein zweiter Durchlauf über ein großes Dokument etwa ein Achtel des ersten, was der Sinn dahinter ist, ein 1M-Token-Fenster mit aggressivem Cache-Pricing zu kombinieren. Batch-Jobs werden zum halben Preis abgerechnet. Benchmarks und wo die offenen Gewichte tatsächlich stehen, erklärt unsere vollständige Qwen-3.8-Analyse.
Neue Konten bekommen das Flaggschiffmodell eine Weile kostenlos. Model Studio verzeichnet ein kostenloses Kontingent von 1 Million Token für 90 Tage auf Qwen3.8-Max, dasselbe Pro-Modell-Kontingent, das Qwens alten kostenlosen Dauertarif ersetzt hat, damit du es an deiner eigenen Arbeitslast testen kannst, bevor du irgendetwas zahlst. Hinweis zur Quellenbestätigung: Alibabas detaillierte internationalen Abrechnungstabellen führen Qwen3.7-Max noch immer als oberstes Max-Modell, also prüfe bei der Rechnungsabstimmung den Preis für deine spezifische Region und deinen Endpunkt, anstatt $2 / $6 pauschal anzunehmen.
Qwen3.7-Max: $1.25 / $3.75 (Vorheriges Flaggschiff)
Qwen3.7-Max war bis August 2026 das Flaggschiffmodell und ist solange sein Rabatt gilt noch immer die beste Wahl für schweres Reasoning, Mathe und Software-Engineering-Aufgaben. Es läuft bei $1.25 Eingabe / $3.75 Ausgabe pro Million Token auf einem 50%-Startrabatt, der Hälfte des Listenpreises von $2.50 / $7.50, mit einem vollen 1M-Token-Kontextfenster. Der Rabatt ist zeitlich begrenzt, also plane bei einer Budgetierung über mehrere Monate mit dem Listenpreis. Qwen3.7-Max erzielte 56,6 auf dem Artificial Analysis Intelligence Index und 80,4 auf SWE-Verified und landete beim Launch in den globalen Top 10. Die vollständige Benchmark-Analyse findest du in unserem Qwen3.7-Max-Test.
Die Tarifsänderung, die Entwickler kennen müssen
Qwen bot früher einen dauerhaften kostenlosen API-Tarif an, der am 15. April 2026 endete. Der kostenlose Entwickler-OAuth-Tarif und der kostenlose Qwen Code CLI-Zugang wurden beide am selben Tag eingestellt, sodass ältere Anleitungen, die „kostenlosen Qwen-API-Zugang" versprechen, jetzt veraltet sind.
Was ihn ersetzt, ist ein einmaliger Onboarding-Test. Neue Alibaba Cloud Model Studio-Konten bekommen 1 Million kostenlose Token pro Modell für rund 70 proprietäre Qwen-Modelle, also insgesamt rund 70 Millionen Token, gültig für 90 Tage und nur auf dem Singapore-Endpunkt. Das ist großzügig für Prototyping, aber es ist ein Test, kein dauerhafter kostenloser Plan, also plane dein Budget für den Zeitpunkt, wenn er abläuft.
So senkst du deine Qwen-Rechnung
Zwei eingebaute Funktionen senken die Realkosten deutlich unter die Schlagzeilenpreise. Die asynchrone Batch-API verarbeitet nicht dringende Jobs zu rund 50 % des Standardpreises, was ideal für Massenauswertungen, Datenbeschriftung oder Nachtverarbeitung ist, wo du keine sofortige Antwort brauchst.
Prompt-Caching ist der zweite Hebel. Wenn du denselben langen Prompt oder Systemkontext für viele Anfragen wiederverwendest, kosten gecachte Eingabe-Lesevorgänge nur einen Bruchteil des normalen Eingabepreises, in manchen Fällen rund 10 % davon. Für Chatbots und Agenten, die bei jedem Aufruf einen großen System-Prompt wiederholen, ist das der Unterschied zwischen einer handhabbaren und einer teuren Rechnung.
Qwen vs. DeepSeek, ChatGPT und Claude im Kostenvergleich
Qwens Stärke ist Preis-Leistung, und es konkurriert direkt mit anderen günstigen Modellen. Gegen DeepSeek, eine weitere chinesische Open-Weight-Familie, die für aggressive Preise bekannt ist, liegen Qwen-Plus und Qwen-Flash im selben Budgetbereich, die Wahl hängt also davon ab, welches Modell bei deinen spezifischen Aufgaben besser abschneidet. Ein weiteres offenes chinesisches Modell, das es zu beobachten lohnt, ist Nex-N2-Pro, das auf Qwens eigener 397B-Architektur aufbaut und auf agentisches Coding zielt. Ebenso ist GLM 5.2 interessant, das 1-Million-Token-Open-Weight-Modell, das jetzt die offenen Coding-Benchmarks anführt; unser GLM-Preisleitfaden zeigt, wie seine Preise gegen Qwen stehen. Alle liegen weit unter US-Flaggschiff-Preisen.
| Modell | Eingabe ($/1M) | Ausgabe ($/1M) | Kontext | Am besten für |
|---|---|---|---|---|
| Qwen-Plus | ab $0.40 | ab $1.20 | 1M | Günstiges Alltagsmodell |
| Qwen3.7-Max | $1.25 | $3.75 | 1M | Vorheriges Flaggschiff, Aktionsrabatt |
| Qwen3.8-Max | $2.00 | $6.00 | 1M | Qwens aktuelles Flaggschiff |
| DeepSeek V4-Pro | $0.66 / $1.32 | $1.98 / $3.96 | 1M | Nächstgünstigster Konkurrent |
| Claude Opus 4.8 | $5.00 | $25.00 | 200K | US-Flaggschiff-Benchmark |
Im Vergleich zu ChatGPT und Claude ist Qwen auf API-Ebene dramatisch günstiger. Claude Opus 4.8 kostet $5 / $25 pro Million Token, sodass selbst Qwens Flaggschiff Qwen3.8-Max unter einem Viertel der Ausgabekosten liegt und Qwen-Plus starke Ergebnisse für ein paar Cent liefert. DeepSeek hat seine Preise am 16. August 2026 erhöht und rechnet jetzt nach Tageszeit ab: V4-Pro kostet $0.66 / $1.98 in der Nebenzeit und das Doppelte in der Spitzenzeit (01:00-04:00 und 06:00-10:00 UTC, Montag bis Freitag), unterbietet Qwen-Plus also auf keiner der beiden Achsen mehr. Die günstigere Stufe V4.1-Flash tut das weiterhin, mit $0.15 / $0.60 in der Nebenzeit nach der Senkung vom 10. September 2026. Wenn der reine Preis pro Token dein entscheidender Faktor ist, gewinnen Qwen und DeepSeek; wenn du das absolute Top der Benchmark-Charts oder spezifische Ökosystem-Funktionen brauchst, ist das Bild weniger eindeutig. Wie die US-Labs abschneiden, erklärt unser Artikel darüber, wie Claude und GPT sich vergleichen; aktuelle Aktionen findest du in unserem Leitfaden zu KI-Gratis-Tests; unseren Mistral AI Preisleitfaden kannst du zum Vergleich heranziehen. Wenn du Qwen neben anderen Modellen an einem Ort möchtest, bieten Aggregatoren wie OpenRouter Qwen ebenfalls auf Pay-as-you-go-Basis an.
Eine einfachere Alternative zur Token-Abrechnung
Token-basierte API-Abrechnung ist mächtig, aber zu aufwändig, wenn du einfach nur beste KI-Modelle im Alltag nutzen möchtest. Eingabe- und Ausgabepreise für verschiedene Modelle zu verfolgen, zu beobachten, wie Eingabegroesstierungen die Rechnung erhöhen, den Ablauf des kostenlosen Tests zu sehen und separate Rechnungen von jedem Anbieter zu verwalten, ist Aufwand, den die meisten Menschen nicht wollen.
Hier kommt Fello AI ins Spiel. Für einen Pauschalpreis von $9.99 pro Monat bekommst du Zugang zu vielen führenden Modellen in einer einzigen Mac-App, darunter Claude, ChatGPT, Gemini, Grok und DeepSeek, ohne Token-Mathematik und ohne mehrere Abos zu verwalten. Statt jede Anfrage abzuzählen, wählt du das beste Modell für die Aufgabe und wechselst frei. Qwen selbst ist in diesem Angebot als nativer Qwen-Desktop-Client für Mac enthalten, ohne Model Studio-Konto einzurichten. Wenn du Flaggschiff-KI ohne API-Abrechnung möchtest, ist dieses Ein-Preis-Viele-Modelle-Setup viel einfacher; du kannst die Auswahl in unserem Überblick der besten KI-Modelle vergleichen und weitere Budgetoptionen in unserem MiniMax-Preisleitfaden finden.
Fazit
Für die meisten Menschen ist Qwen faktisch kostenlos, die Qwen Chat App kostet nichts und deckt den Alltag ab. Für Entwickler ist Qwen eine der besten preis-leistungsmäßigen APIs, von $0.05 pro Million Token auf Qwen-Flash bis zum Flaggschiff, das US-Konkurrenten noch immer deutlich unterbietet. Denk daran: Der kostenlose API-Tarif ist seit April 2026 weggefallen, mehrere Preise sind nach Promptlänge gestaffelt, und der Qwen3.7-Max-Rabatt ist temporär, also kalkuliere mit Listenpreisen und nutze Batch-Verarbeitung und Prompt-Caching, um die Kosten niedrig zu halten. Wenn du Token-Abrechnung ganz überspringen möchtest, gibt dir eine Pauschalpreis-Multi-Modell-App wie Fello AI Qwen-Klasse-Wert neben Claude, ChatGPT und Gemini für einen monatlichen Preis.
FAQ
Was kostet Qwen?
Die Qwen Chat App ist kostenlos. Auf der API reichen die Preise von $0.05 Eingabe / $0.40 Ausgabe pro Million Token für Qwen-Flash bis zu $2.00 / $6.00 für das Flaggschiff Qwen3.8-Max, das seit seiner allgemeinen Verfügbarkeit am 3. August 2026 einen Pauschalpreis über das gesamte 1M-Kontextfenster berechnet. Das vorherige Flaggschiff Qwen3.7-Max ist noch zu $1.25 / $3.75 auf einer 50%-Aktion (Listenpreis $2.50 / $7.50) gelistet, und das beliebte Mid-Tier-Modell Qwen-Plus beginnt bei $0.40 / $1.20.
Ist Qwen kostenlos nutzbar?
Ja, die Consumer Qwen Chat App auf chat.qwen.ai ist kostenlos ohne Abo. Du zahlst nur, wenn du die Qwen API über Alibaba Cloud Model Studio nutzt, die pro Token abrechnet.
Warum ist meine Qwen-API-Rechnung bei einem langen Prompt gestiegen?
Mehrere Qwen-Modelle sind nach Eingabegröße gestaffelt, der Token-Preis steigt also, wenn dein Prompt länger wird. Qwen3-Max geht beispielsweise von $1.20 / $6.00 auf bis zu $3.00 / $15.00 in der größten Eingabestaffel, und der Thinking-Modus erhoht auch die Ausgabekosten. Die Schlagzeilenpreise sind Einstiegsstaffelpreise. Qwen3.8-Max ist die Ausnahme und berechnet einen pauschalen $2.00 / $6.00 bei jeder Promptlänge.
Gibt es noch einen kostenlosen Qwen-API-Tarif?
Nicht als Dauertarif. Der kostenlose Entwickler-API-Tarif endete am 15. April 2026. Neue Konten bekommen stattdessen einen einmaligen Test von 1 Million Token pro Modell, insgesamt rund 70 Millionen, gültig für 90 Tage auf dem Singapore-Endpunkt.
Ist Qwen günstiger als ChatGPT?
Auf API-Ebene ja, erheblich. Qwen-Plus und Qwen-Flash kosten einen Bruchteil dessen, was Premium-US-Flaggschiffmodelle pro Token verlangen, weshalb Qwen und DeepSeek bei kostenempfindlichen Projekten beliebt sind.