Die Qwen-Preisgestaltung teilt sich in zwei sehr unterschiedliche Wege, und die meisten Menschen brauchen nur den kostenlosen. Die Qwen Chat App ist vollstaendig kostenlos ohne Abo, waehrend Entwickler ueber die API pro Token zahlen, wo die Preise von $0.05 pro Million Eingabe-Token beim guenstigsten Modell bis zu $6.00 pro Million Ausgabe-Token beim Flaggschiffmodell Qwen3.8-Max reichen. Dieser 120-fache Unterschied zwischen dem guenstigsten und dem Flaggschiff-Preis ist das Wichtigste, das du verstehen solltest, bevor du ein Modell auswaehlen.

Dieser Leitfaden erklaert alle Teile der Qwen-Preise fuer 2026: die kostenlose Qwen Chat App, die Pay-as-you-go-API-Preise fuer jedes Modell, die Eingabegroesstierungen, die manche Preise still erhoehen, den kostenlosen Token-Test fuer neue Entwickler und wie Qwen bei den Kosten gegen DeepSeek und Claude abschneidet. Wir behandeln auch die Aenderung, die viele Entwickler kalt erwischt hat: das Ende des kostenlosen API-Tarifs am 15. April 2026, und wo Qwen noch den besten Gegenwert bietet.

Das Wichtigste im Ueberblick

  • Qwen Chat ist kostenlos, ohne Consumer-Abo wie ChatGPT Plus oder Claude Pro.
  • API-Preise reichen von $0.05 / $0.40 pro Million Token (Qwen-Flash) bis $2.00 / $6.00 beim Flaggschiffmodell Qwen3.8-Max, allgemein verfuegbar seit dem 3. August 2026. Das vorherige Flaggschiff Qwen3.7-Max ist mit $1.25 / $3.75 auf einer 50%-Aktion (Listenpreis $2.50 / $7.50) noch guenstiger.
  • Das Mid-Tier-Modell Qwen-Plus beginnt bei $0.40 / $1.20 pro Million Token und ist die beste Balance aus Preis und Leistung fuer die meisten Apps.
  • Mehrere Qwen-Modelle sind nach Eingabegroesse gestaffelt, der Schlagzeilen-Preis ist also ein „ab"-Preis, der bei langen Prompts steigt (Qwen3-Max laeuft von $1.20 bis $3.00 Eingabe ueber sein 262K-Kontextfenster). Qwen3.8-Max ist die Ausnahme: Es berechnet einen einzigen Pauschalpreis ueber sein gesamtes 1M-Fenster.
  • Der kostenlose Entwickler-API-Tarif endete am 15. April 2026 und wurde durch einen einmaligen Test von 1 Million Token pro Modell (insgesamt rund 70 Millionen) fuer neue Konten ersetzt.

Qwen-Preise auf einen Blick

Vom Herausgeber

Jedes KI-Modell in einer App

Fello AI vereint GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 und mehr in einer nativen App für Mac und iPhone.

Jetzt herunterladen!

Qwen ist Alibabas Familie von KI-Modellen, und du kannst es auf zwei Arten nutzen. Die Consumer-Qwen Chat App auf chat.qwen.ai ist kostenlos, und die Entwickler-API wird pro Token ueber Alibaba Cloud Model Studio abgerechnet (die Plattform, die frueher als DashScope bekannt war). Es gibt keinen flachen monatlichen Consumer-Plan dazwischen, was Qwen gegenueber westlichen Konkurrenten ungewoehnlich macht. Qwens offene Basismodelle bekaeftigen auch Drittanbieter-Fine-Tunes, darunter Rio 3.5 Open 397B der Stadtverwaltung von Rio de Janeiro.

Hier sind die Kosten der wichtigsten Textmodelle auf der API, Preis pro Million Token. Eingabe ist, was du fuer den Text zahlst, den du schickst, und Ausgabe ist, was du fuer den Text zahlst, den das Modell zurueckgibt.

ModellEingabe ($/1M)Ausgabe ($/1M)KontextfensterAm besten fuer
Qwen-Flashab $0.05ab $0.401M TokenVolumenstarke, einfache Aufgaben
Qwen-Plusab $0.40ab $1.201M TokenDas Alltagsarbeitspferd
Qwen3.7-Plusab $0.32ab $1.281M TokenMultimodale Apps
Qwen3-Maxab $1.20ab $6.00262K TokenSchweres Reasoning, Coding
Qwen3.7-Max$1.25$3.751M TokenVorheriges Flaggschiff, guenstigste Aktion
Qwen3.8-Max$2.00$6.001M TokenFlaggschiff, Pauschalpreis bei beliebiger Laenge

Qwen3.8-Max uebernahm den Flaggschiff-Platz am 3. August 2026 zum Pauschalpreis von $2.00 / $6.00. Sein Vorgaenger Qwen3.7-Max bleibt im Preiskatalog zu $1.25 / $3.75, einem 50-prozentigen Aktionsrabatt auf den Listenpreis von $2.50 / $7.50. Lies beide Zeilen zusammen: Solange die Aktion laeuft, ist das aeltere Modell das guenstigere; sobald sie endet, ist es das teurere. Alibaba hat kein Enddatum fuer diesen Rabatt angekuendigt, also budgetiere bei langfristigen Projekten mit Listenpreisen.

Ein Hinweis zum Lesen dieser Zahlen: Model Studio staffelt mehrere Preise nach der Eingabegroesse jeder Anfrage, die oben genannten „ab"-Preise sind also die Einstiegsstaffeln, und deine Kosten steigen bei laengeren Prompts. Bestaetigung die aktuellen Preise fuer dein Modell und deine Region immer in den Alibaba Cloud Model Studio Preisdokumenten, bevor du ein Budget erstellst.

Ist Qwen kostenlos?

Ja. Die Qwen Chat App auf chat.qwen.ai ist kostenlos ohne Abo, aehnlich wie die Gratisversion von ChatGPT oder Gemini. Du bekommst Zugang zu Qwens starken Modellen fuer alltaegliches Chatten, Schreiben, Coding-Hilfe und Bildaufgaben, ohne irgendetwas zu zahlen, und Alibaba hat klare kommerzielle Gruende, die Consumer-App kostenlos zu halten.

Bezahlte Preise kommen erst ins Spiel, wenn du auf der Qwen API ueber Alibaba Cloud Model Studio entwickelst, die pro Token abrechnet. Wenn du also einfach mit Qwen chatten moechtest, zahlst du nichts. Wenn du Qwen in dein eigenes Produkt einbinden moechtest, zahlst du nach Nutzung.

Qwen-API-Preise nach Modell

Im Folgenden haben wir die API-Preise fuer jedes Qwen-Modell aufgeschluesselt, damit du das richtige Tier fuer deine Arbeitslast und dein Budget findest.

Qwen-Flash und Qwen-Turbo: ab $0.05 / $0.40

Qwen-Flash ist das Budget-Tier bei ab $0.05 Eingabe / $0.40 Ausgabe pro Million Token fuer Prompts bis 256K, steigt auf $0.25 / $2.00 bei laengeren Eingaben. Es ist auf Geschwindigkeit und hohe Volumen ausgelegt und eignet sich fuer Klassifizierung, einfache Frage-und-Antwort, Tagging und alle Aufgaben, bei denen du viele Anfragen sendest und kein Flaggschiff-Reasoning benoedigst. Qwen-Flash ersetzt jetzt das aeltere Qwen-Turbo, das Alibaba als nicht mehr aktualisiert markiert hat, also sollten neue Projekte standardmaessig Flash verwenden. Zu diesen Preisen kannst du Millionen von Token fuer ein paar Dollar verarbeiten.

Qwen-Plus: ab $0.40 / $1.20

Qwen-Plus liegt in der Mitte bei ab $0.40 Eingabe / $1.20 Ausgabe pro Million Token und ist das Modell, mit dem die meisten Apps beginnen sollten. Es ist nach Promptlaenge gestaffelt, der Preis steigt also auf $1.20 Eingabe / $3.60 Ausgabe, sobald eine einzelne Anfrage 256K Token uebersteigt, und der Thinking-Modus erhoht die Ausgabe weiter. Es bewaeltigt den Grossteil der echten Arbeit, Zusammenfassen, Entwerfen, Coding-Unterstuetzung und Retrieval-Aufgaben, zu einem Preis, der im grossen Massstab vernuenftig bleibt.

Qwen3.7-Plus: ab $0.32 / $1.28

Qwen3.7-Plus ist Qwens multimodales Mid-Tier-Modell, das Text-, Bild- und Videoeingaben akzeptiert. Es laeuft bei ab $0.32 Eingabe / $1.28 Ausgabe pro Million Token, ein Rabatt von 20 % auf den Listenpreis von $0.40 / $1.60, und wie Qwen-Plus wird es bei langem Kontext nach oben gestaffelt. Wenn du Apps entwickelst, die Bilder oder Video mit Text mischen, und guenstig bleiben moechtest, solltest du dieses Tier testen, bevor du zu einem Max-Modell wechselst.

Qwen3-Max: ab $1.20 / $6.00

Qwen3-Max ist das leistungsstarke Reasoning-Modell, Preis ab $1.20 Eingabe / $6.00 Ausgabe pro Million Token fuer Prompts bis 32K. Die Kosten steigen in Staffeln: $2.40 / $12 von 32K bis 128K und $3.00 / $15 bis zum Limit, sodass Long-Context-Jobs deutlich mehr kosten, als der Schlagzeilen-Preis vermuten laesst. Beachte, dass Qwen3-Max bei 262K Token Kontext endet und nicht die vollen 1M erreicht, die kleinere Qwen-Modelle bieten.

Qwen3.8-Max: $2.00 / $6.00 (Flaggschiff)

Qwen3.8-Max wurde am 3. August 2026 allgemein verfuegbar und steht an der Spitze des Angebots: ein 2,4-Billionen-Parameter-Mixture-of-Experts-Modell, das pro Token rund 95 Milliarden Parameter aktiviert. Es akzeptiert Text-, Bild- und Videoeingaben, gibt bis zu 128K Ausgabe-Token zurueck und kostet $2.00 Eingabe / $6.00 Ausgabe pro Million Token. Anders als alle anderen Modelle auf dieser Seite ist dieser Preis ueber das gesamte 1M-Token-Kontextfenster pauschal. 5.000 oder 900.000 Token, der Preis pro Token aendert sich nicht, was die Eingabegroessklippe eliminiert, die Qwen3-Max- und Qwen-Plus-Rechnungen schwer vorhersagbar macht.

Die Ersparnis steckt im Caching. Implizites Caching von Eingaben kostet $0.25 pro Million, explizite Cache-Lesevorgaenge fallen auf $0.17, und das Schreiben in einen expliziten Cache kostet $2.50. Zu diesen Preisen kostet ein zweiter Durchlauf ueber ein grosses Dokument etwa ein Achtel des ersten, was der Sinn dahinter ist, ein 1M-Token-Fenster mit aggressivem Cache-Pricing zu kombinieren. Batch-Jobs werden zum halben Preis abgerechnet. Benchmarks und wo die offenen Gewichte tatsaechlich stehen, erklaert unsere vollstaendige Qwen-3.8-Analyse.

Neue Konten bekommen das Flaggschiffmodell eine Weile kostenlos. Model Studio verzeichnet ein kostenloses Kontingent von 1 Million Token fuer 90 Tage auf Qwen3.8-Max, dasselbe Pro-Modell-Kontingent, das Qwens alten kostenlosen Dauertarif ersetzt hat, damit du es an deiner eigenen Arbeitslast testen kannst, bevor du irgendetwas zahlst. Hinweis zur Quellenbestaetigung: Alibabas detaillierte internationalen Abrechnungstabellen fuehren Qwen3.7-Max noch immer als oberstes Max-Modell, also pruefe bei der Rechnungsabstimmung den Preis fuer deine spezifische Region und deinen Endpunkt, anstatt $2 / $6 pauschal anzunehmen.

Qwen3.7-Max: $1.25 / $3.75 (Vorheriges Flaggschiff)

Qwen3.7-Max war bis August 2026 das Flaggschiffmodell und ist solange sein Rabatt gilt noch immer die beste Wahl fuer schweres Reasoning, Mathe und Software-Engineering-Aufgaben. Es laeuft bei $1.25 Eingabe / $3.75 Ausgabe pro Million Token auf einem 50%-Startrabatt, der Haelfte des Listenpreises von $2.50 / $7.50, mit einem vollen 1M-Token-Kontextfenster. Der Rabatt ist zeitlich begrenzt, also plane bei einer Budgetierung ueber mehrere Monate mit dem Listenpreis. Qwen3.7-Max erzielte 56,6 auf dem Artificial Analysis Intelligence Index und 80,4 auf SWE-Verified und landete beim Launch in den globalen Top 10. Die vollstaendige Benchmark-Analyse findest du in unserem Qwen3.7-Max-Test.

Die Tarifsaenderung, die Entwickler kennen muessen

Qwen bot frueher einen dauerhaften kostenlosen API-Tarif an, der am 15. April 2026 endete. Der kostenlose Entwickler-OAuth-Tarif und der kostenlose Qwen Code CLI-Zugang wurden beide am selben Tag eingestellt, sodass aeltere Anleitungen, die „kostenlosen Qwen-API-Zugang" versprechen, jetzt veraltet sind.

Was ihn ersetzt, ist ein einmaliger Onboarding-Test. Neue Alibaba Cloud Model Studio-Konten bekommen 1 Million kostenlose Token pro Modell fuer rund 70 proprietaere Qwen-Modelle, also insgesamt rund 70 Millionen Token, gueltig fuer 90 Tage und nur auf dem Singapore-Endpunkt. Das ist grosszuegig fuer Prototyping, aber es ist ein Test, kein dauerhafter kostenloser Plan, also plane dein Budget fuer den Zeitpunkt, wenn er ablaeuft.

So senkst du deine Qwen-Rechnung

Zwei eingebaute Funktionen senken die Realkosten deutlich unter die Schlagzeilenpreise. Die asynchrone Batch-API verarbeitet nicht dringende Jobs zu rund 50 % des Standardpreises, was ideal fuer Massenauswertungen, Datenbeschriftung oder Nachtverarbeitung ist, wo du keine sofortige Antwort brauchst.

Prompt-Caching ist der zweite Hebel. Wenn du denselben langen Prompt oder Systemkontext fuer viele Anfragen wiederverwendest, kosten gecachte Eingabe-Lesevorgaenge nur einen Bruchteil des normalen Eingabepreises, in manchen Faellen rund 10 % davon. Fuer Chatbots und Agenten, die bei jedem Aufruf einen grossen System-Prompt wiederholen, ist das der Unterschied zwischen einer handhabbaren und einer teuren Rechnung.

Qwen vs. DeepSeek, ChatGPT und Claude im Kostenvergleich

Qwens Staerke ist Preis-Leistung, und es konkurriert direkt mit anderen guenstigen Modellen. Gegen DeepSeek, eine weitere chinesische Open-Weight-Familie, die fuer aggressive Preise bekannt ist, liegen Qwen-Plus und Qwen-Flash im selben Budgetbereich, die Wahl haengt also davon ab, welches Modell bei deinen spezifischen Aufgaben besser abschneidet. Ein weiteres offenes chinesisches Modell, das es zu beobachten lohnt, ist Nex-N2-Pro, das auf Qwens eigener 397B-Architektur aufbaut und auf agentisches Coding zielt. Ebenso ist GLM 5.2 interessant, das 1-Million-Token-Open-Weight-Modell, das jetzt die offenen Coding-Benchmarks anfuehrt; unser GLM-Preisleitfaden zeigt, wie seine Preise gegen Qwen stehen. Alle liegen weit unter US-Flaggschiff-Preisen.

ModellEingabe ($/1M)Ausgabe ($/1M)KontextAm besten fuer
Qwen-Plusab $0.40ab $1.201MGuenstiges Alltagsmodell
Qwen3.7-Max$1.25$3.751MVorheriges Flaggschiff, Aktionsrabatt
Qwen3.8-Max$2.00$6.001MQwens aktuelles Flaggschiff
DeepSeek V4$0.435$0.871MNaechstguengstigster Konkurrent
Claude Opus 4.8$5.00$25.00200KUS-Flaggschiff-Benchmark

Im Vergleich zu ChatGPT und Claude ist Qwen auf API-Ebene dramatisch guenstiger. Claude Opus 4.8 kostet $5 / $25 pro Million Token, sodass selbst Qwens Flaggschiff Qwen3.8-Max unter einem Viertel der Ausgabekosten liegt und Qwen-Plus starke Ergebnisse fuer ein paar Cent liefert. DeepSeek V4 unterbietet das gesamte Feld bei $0.435 / $0.87. Wenn der reine Preis pro Token dein entscheidender Faktor ist, gewinnen Qwen und DeepSeek; wenn du das absolute Top der Benchmark-Charts oder spezifische Oekosystem-Funktionen brauchst, ist das Bild weniger eindeutig. Wie die US-Labs abschneiden, erklaert unser Artikel darueber, wie Claude und GPT sich vergleichen; aktuelle Aktionen findest du in unserem Leitfaden zu KI-Gratis-Tests; unseren Mistral AI Preisleitfaden kannst du zum Vergleich heranziehen. Wenn du Qwen neben anderen Modellen an einem Ort moechtest, bieten Aggregatoren wie OpenRouter Qwen ebenfalls auf Pay-as-you-go-Basis an.

Eine einfachere Alternative zur Token-Abrechnung

Token-basierte API-Abrechnung ist maeChtig, aber zu aufwaendig, wenn du einfach nur beste KI-Modelle im Alltag nutzen moechtest. Eingabe- und Ausgabepreise fuer verschiedene Modelle zu verfolgen, zu beobachten, wie Eingabegroesstierungen die Rechnung erhoehen, den Ablauf des kostenlosen Tests zu sehen und separate Rechnungen von jedem Anbieter zu verwalten, ist Aufwand, den die meisten Menschen nicht wollen.

Hier kommt Fello AI ins Spiel. Fuer einen Pauschalpreis von $9.99 pro Monat bekommst du Zugang zu vielen fuehrenden Modellen in einer einzigen Mac-App, darunter Claude, ChatGPT, Gemini, Grok und DeepSeek, ohne Token-Mathematik und ohne mehrere Abos zu verwalten. Statt jede Anfrage abzuzaehlen, waehlt du das beste Modell fuer die Aufgabe und wechselst frei. Qwen selbst ist in diesem Angebot als nativer Qwen-Desktop-Client fuer Mac enthalten, ohne Model Studio-Konto einzurichten. Wenn du Flaggschiff-KI ohne API-Abrechnung moechtest, ist dieses Ein-Preis-Viele-Modelle-Setup viel einfacher; du kannst die Auswahl in unserem Ueberblick der besten KI-Modelle vergleichen und weitere Budgetoptionen in unserem MiniMax-Preisleitfaden finden.

Fazit

Fuer die meisten Menschen ist Qwen faktisch kostenlos, die Qwen Chat App kostet nichts und deckt den Alltag ab. Fuer Entwickler ist Qwen eine der besten preis-leistungsmaessigen APIs, von $0.05 pro Million Token auf Qwen-Flash bis zum Flaggschiff, das US-Konkurrenten noch immer deutlich unterbietet. Denk daran: Der kostenlose API-Tarif ist seit April 2026 weggefallen, mehrere Preise sind nach Promptlaenge gestaffelt, und der Qwen3.7-Max-Rabatt ist temporaer, also kalkuliere mit Listenpreisen und nutze Batch-Verarbeitung und Prompt-Caching, um die Kosten niedrig zu halten. Wenn du Token-Abrechnung ganz ueberspringen moechtest, gibt dir eine Pauschalpreis-Multi-Modell-App wie Fello AI Qwen-Klasse-Wert neben Claude, ChatGPT und Gemini fuer einen monatlichen Preis.

FAQ

Was kostet Qwen?

Die Qwen Chat App ist kostenlos. Auf der API reichen die Preise von $0.05 Eingabe / $0.40 Ausgabe pro Million Token fuer Qwen-Flash bis zu $2.00 / $6.00 fuer das Flaggschiff Qwen3.8-Max, das seit seiner allgemeinen Verfuegbarkeit am 3. August 2026 einen Pauschalpreis ueber das gesamte 1M-Kontextfenster berechnet. Das vorherige Flaggschiff Qwen3.7-Max ist noch zu $1.25 / $3.75 auf einer 50%-Aktion (Listenpreis $2.50 / $7.50) gelistet, und das beliebte Mid-Tier-Modell Qwen-Plus beginnt bei $0.40 / $1.20.

Ist Qwen kostenlos nutzbar?

Ja, die Consumer Qwen Chat App auf chat.qwen.ai ist kostenlos ohne Abo. Du zahlst nur, wenn du die Qwen API ueber Alibaba Cloud Model Studio nutzt, die pro Token abrechnet.

Warum ist meine Qwen-API-Rechnung bei einem langen Prompt gestiegen?

Mehrere Qwen-Modelle sind nach Eingabegroesse gestaffelt, der Token-Preis steigt also, wenn dein Prompt laenger wird. Qwen3-Max geht beispielsweise von $1.20 / $6.00 auf bis zu $3.00 / $15.00 in der groessten Eingabestaffel, und der Thinking-Modus erhoht auch die Ausgabekosten. Die Schlagzeilenpreise sind Einstiegsstaffelpreise. Qwen3.8-Max ist die Ausnahme und berechnet einen pauschalen $2.00 / $6.00 bei jeder Promptlaenge.

Gibt es noch einen kostenlosen Qwen-API-Tarif?

Nicht als Dauertarif. Der kostenlose Entwickler-API-Tarif endete am 15. April 2026. Neue Konten bekommen stattdessen einen einmaligen Test von 1 Million Token pro Modell, insgesamt rund 70 Millionen, gueltig fuer 90 Tage auf dem Singapore-Endpunkt.

Ist Qwen guenstiger als ChatGPT?

Auf API-Ebene ja, erheblich. Qwen-Plus und Qwen-Flash kosten einen Bruchteil dessen, was Premium-US-Flaggschiffmodelle pro Token verlangen, weshalb Qwen und DeepSeek bei kostenempfindlichen Projekten beliebt sind.