Alibabův Qwen3.7-Max byl uveden 20. května 2026 na Alibaba Cloud Summitu v Hangzhou a čísla mluví za vše. Při spuštění dosáhl skóre 56,6 na Artificial Analysis Intelligence Index (v daném týdnu 5. místo, aktuálně v top 10 ze 151 měřených modelů) a stal se nejvýše hodnoceným čínským AI modelem na tomto žebříčku vůbec. Model disponuje kontextovým oknem 1 milionu tokenů, vstupní cena API činí $2.50 za 1 milion vstupních tokenů a Alibabovo interní testování reportuje 35hodinový autonomní kódovací běh, při kterém model provedl 1 158 volání nástrojů a dosáhl 10× zrychlení oproti standardní referenční implementaci Triton.
Je tedy skutečně lepší než GPT-5.5, Claude Opus 4.7 nebo Gemini 3.5? Krátká odpověď: z hlediska poměru ceny a výkonu je Qwen3.7-Max nyní jedním z nejsilnějších frontierových modelů, které lze volat přes API. Delší odpověď: v tom, jak model dosahuje svého skóre u halucinací, je jedna výhrada, o které byste měli vědět, než na něj vsadíte svůj pracovní postup. Prošli jsme zveřejněné benchmarky, zjistili jsme oficiální ceny a rozebrali, co toto vydání skutečně znamená pro kódování, agenty a prostor AI nástrojů na přelomu roku 2026.
Klíčová zjištění
- Qwen3.7-Max dosahuje skóre 56,6 na Artificial Analysis Intelligence Index, celosvětově je v top 10 a dosáhl nejvyššího umístění pro čínský model vůbec
- Kontextové okno 1 milionu tokenů a maximální výstup 65 536 tokenů, s prodlouženým přemýšlením zapnutým jako výchozím nastavením
- Cena API je $2.50 vstup / $7.50 výstup za 1 milion tokenů, přičemž kešovaný vstup klesá na $0.25 za 1 milion (sleva 90 %)
- Prokázáno 35 hodin nepřetržitého autonomního kódování, 1 158 volání nástrojů a 10× geometrické zrychlení oproti referenčnímu kernelu Triton
- Proprietární model (žádné otevřené váhy), dostupný přes Alibaba Cloud Model Studio, OpenRouter a přímou integraci Claude Code prostřednictvím protokolu Anthropic API
Co je Qwen3.7-Max?
Qwen3.7-Max je proprietární vlajkový uvažovací model Alibaby navržený jako „základ pro agenty", nikoli jako obecný chatovací asistent. Je nástupcem modelu Qwen3.6 Max Preview a prvním modelem Qwen, který překonává hranici kontextu 1 milionu tokenů, přičemž skočil z 256 tisíc. Jako výchozí nastavení používá prodloužené chain-of-thought uvažování a je pozicionován jako přímý konkurent GPT-5.5, Claude Opus 4.7 a Gemini 3.5 Flash u úloh vyžadujících dlouhodobou autonomii.
Společně s Qwen3.7-Max Alibaba tiše vydala Qwen3.7-Plus-Preview, multimodální variantu, která přidává obrazový vstup a funguje za nižší cenu. Plus je ekonomická volba pro objemné rutinní pracovní postupy, zatímco Max je výkonný hráč pro uvažování, agentové kódování a dokumentový rozsah kontextu. Na rozdíl od mnoha dřívějších verzí Qwen není ani jeden model open-weight; oba fungují pouze přes hostované API Alibaby. V červnu 2026 vydala vláda brazilského Rio de Janeira Rio 3.5 Open 397B, open-weight fine-tune, který se srovnává s Qwen 3.7 Plus.
Benchmarky: Jak si Qwen3.7-Max stojí v porovnání
Čísla při spuštění jsou celkově silná. Podle Artificial Analysis se Qwen3.7-Max na celkovém Intelligence Index pohybuje mezi Gemini 3.5 Flash a Claude Opus 4.7, ale na řadě náročných uvažovacích benchmarků si vede nad své zařazení.
| Model | AA Intelligence Index | Vstup $/M | Výstup $/M | Kontext |
|---|---|---|---|---|
| GPT-5.5 | 60,2 | $5.00 | $30.00 | 1M |
| Claude Opus 4.7 | 57,3 | $5.00 | $25.00 | 1M |
| Qwen3.7-Max | 56,6 | $2.50 | $7.50 | 1M |
| Gemini 3.5 Flash | 55,3 | $1.50 | $9.00 | 1M |
| DeepSeek V4 Pro | 52,0 | $1.74 | $3.48 | 1M |
V jednotlivých benchmarcích dosahuje Qwen3.7-Max skóre 92,4 na GPQA Diamond (před Claude Opus 4.6 Max s 91,3, za GPT-5.5 s 93,6) a 97,1 na HMMT 2026 February, což je nejvyšší skóre ve srovnávací skupině. Dále dosahuje 44,5 na Apex (výrazně před DeepSeek V4 Pro s 38,3), 80,4 na SWE-Verified pro softwarové inženýrství a 41,4 na Humanity's Last Exam, čímž těsně překonává Opus 4.6 Max s 40,0.
Upřímná výhrada: nízká míra halucinací Qwen3.7-Max je částečně artefaktem vyšší míry odmítnutí. Podle analýzy benchmarků od Officechai klesla míra pokusů modelu na 48,0 %, což je nejnižší hodnota mezi srovnatelnými frontierovými modely. Jinými slovy, model častěji odmítá odpovídat, čímž snižuje počet špatných odpovědí, ale zároveň snižuje užitečnost v hraničních případech. Tento kompromis je důležitý, pokud model zapojujete do agenta, který potřebuje procházet nejasnostmi.
Ceny: $2.50 vstup, $7.50 výstup, $0.25 kešovaný
Qwen3.7-Max je v současnosti jeden z cenově výhodnějších frontierových modelů na trhu. API stojí $2.50 za 1 milion vstupních tokenů a $7.50 za 1 milion výstupních tokenů, s maximálním výstupem 65 536 tokenů na požadavek. Kešovaný vstup klesá na $0.25 za 1 milion tokenů, tedy 90% sleva, která zdražuje opakovaná volání s dlouhým kontextem.
$0.25 za kešovaný vstup je zabijácká funkce
Pro agentové pracovní postupy, které znovu čtou stejnou kódovou základnu, dokument nebo historii konverzace v průběhu stovek otočení, mění cenová sleva za keš Qwen3.7-Max na cenového outlidera. Claude Opus 4.7 účtuje $5 za 1 milion vstupních tokenů a $25 za výstup, tedy dvojnásobek vstupu a více než trojnásobek výstupní ceny Qwen3.7-Max. GPT-5.5 je $5 vstup a $30 výstup, nejdražší z celé skupiny. Gemini 3.5 Flash ($1.50/$9) a DeepSeek V4 Pro ($1.74/$3.48) jsou levnější, ale na uvažovacích benchmarcích dosahují nižších skóre. Pokud váš pracovní postup zahrnuje „dlouhý kontext, mnoho volání nástrojů a občasné přemýšlení", Qwen3.7-Max se pohybuje ve sladkém místě mezi frontierovým výkonem a frontierovou cenou.
Kde za něj zaplatit
API je dostupné na Alibaba Cloud Model Studio, OpenRouter a Together AI, přičemž Qwen Chat (chat.qwen.ai) nabízí omezený bezplatný náhled přes web. Neexistuje žádný trvalý bezplatný tarif a varianta Plus-Preview je v API pouze textová, přestože přes chatovací rozhraní přijímá obrázkový vstup.
35hodinový autonomní běh: co se skutečně stalo
Hlavní demonstrací při spuštění byl 35hodinový nepřetržitý autonomní kódovací běh a zaslouží si bližší pohled, protože většina článků o spuštění přešla přes to, co se skutečně stalo, bez zastavení. Podle interního testování Alibaby (žádné nezávislé ověření dosud nebylo zveřejněno) dostal Qwen3.7-Max izolovaný server vybavený AI akcelerátorem Zhenwu M890, zcela novou hardwarovou architekturou, kterou model při tréninku nikdy neviděl. Úkolem bylo optimalizovat attention kernel od nuly.
Během 35 nepřetržitých hodin model provedl 1 158 různých volání nástrojů, spustil 432 vyhodnocení kernelu, sám diagnostikoval chyby kompilace a iterativně přepsal svůj kód. Výsledkem bylo 10× geometrické průměrné zrychlení oproti referenční implementaci Triton, jak uvádí VentureBeat. Tato jediná demonstrace není důkazem obecné agentní inteligence, ale ukazuje, že model dokáže udržet kontext, zotavit se ze selhání a zůstat koherentní po dobu, kdy většina ostatních uvažovacích modelů začíná halucinovat proměnné nebo se zacyklovat.
Pro vývojáře je praktický závěr tento: pokud provozujete kódovacího agenta nebo výzkumného asistenta přes noc, Qwen3.7-Max je nyní jedním z mála modelů testovaných při takové délce běhu. Zda vaše peněženka zvládne výdaje na tokeny, je samostatná otázka.
Kde Qwen3.7-Max vyzkoušet
Existují čtyři cesty, jak si model vyzkoušet, a vaše volba závisí na tom, zda chcete chatovací rozhraní, API nebo harness pro agenty.
Qwen Chat (chat.qwen.ai) je vstupní bod s bezplatným náhledem. Má denní limit zpráv a přes rozevírací seznam zpřístupňuje Qwen3.7-Max i Qwen3.7-Plus-Preview. Hodí se pro vyzkoušení před tím, než se zavážete k výdajům na API.
Alibaba Cloud Model Studio je oficiální domov API s plným ceníkem a nejdelšími limity kontextu. Budete potřebovat účet Alibaba Cloud, což znamená větší tření než u jiných poskytovatelů, ale umožňuje kešování promptů a přímou podporu.
OpenRouter zrcadlí model za stejný cenový tarif a přihlášení je snazší, zejména pokud přes jeden klíč již směrujete více modelů. Together AI ho hostuje také pro pracovní postupy s fine-tuningem.
Claude Code je ta, která lidi překvapila. Qwen3.7-Max nativně podporuje protokol Anthropic API, takže Claude Code, OpenClaw nebo jakýkoli jiný harness kompatibilní s Anthropic můžete namířit na endpoint Qwenu a použít ho jako náhradu. Pokud vás cena Claude Code přestala být dostupná, ale chcete stejný pracovní postup, jde o nejlevnější věrohodnou alternativu, k níž jste v posledních měsících měli přístup.
Pokud raději přeskočíte nastavení API a chcete jednoduše porovnávat frontierové modely z jedné aplikace, aplikace Fello AI pro Mac a iOS sdružuje Claude, ChatGPT, Gemini, Grok a DeepSeek pod jedno předplatné za $9.99/měsíc, takže můžete A/B testovat prompty napříč poskytovateli bez žonglování se samostatnými fakturačními účty.
Verdikt: Máte přejít?
Qwen3.7-Max je dosud nejdůvěryhodnějším čínským frontierovým modelem a cenová politika z něj dělá přirozenou volbu pro cenově citlivé agentové a dlouhokontextové pracovní postupy. Pokud vás brzdí účty za API GPT-5.5 nebo Claude Opus 4.7, je to nejpřímější způsob, jak snížit náklady, aniž byste klesli do kategorie „Gemini 3.5 Flash, ale o něco horší v uvažování".
Přejít byste měli, pokud stavíte agenty, kteří běží hodiny, pracujete s kontexty o milionech tokenů nebo potřebujete sazbu $0.25 za kešovaný vstup, aby byl váš případ použití ziskový. Přejít byste neměli, pokud váš pracovní postup závisí na plné multimodální vizi (použijte Plus-Preview nebo počkejte na Max-Vision), nebo pokud vaše aplikace nemůže tolerovat vyšší míru odmítnutí u těžkých otázek. Pro čistou surovou inteligenci a sledování instrukcí na absolutní frontě stále vede GPT-5.5 na Intelligence Index, ale cenový rozdíl se prohlubuje.
Větší příběh je v tom, co toto spuštění signalizuje. Alibaba nyní dodává proprietární model, který se přímou vazbou napojuje na vlastní AI akcelerátor (Zhenwu M890) a rackový server (Panjiu AL128), ve stejném týdnu, na stejném pódiu. Jde o full-stack AI přístup, ke kterému směřují i NVIDIA a OpenAI, a Alibaba je prvním čínským výrobcem, který se do tohoto závodu věrohodně zapojil. Qwen3.7-Max je modelovou vrstvou této sázky a na základě čísel, která máme k dispozici, se sázka vyplácí.
Pro širší obraz o tom, jak čínské AI laboratoře tak rychle dohnaly, nabízí kontext náš hloubkový pohled na čínský AI závod a náš článek o Kimi K2.5. Pokud hledáte nejlepší bezplatné modely pro kódování, Qwen3.7-Max není zdarma, ale stojí za to ho srovnat z hlediska poměru benchmarku a ceny. Pro nejnovější v tomto rodokmenu viz náš průvodce Kimi K2.7 Code, nejnovějším open-weight kódovacím modelem Moonshotu.
Qwen není v tomto měsíci jediným čínským frontierovým tahem. MiniMax představil MiniMax M3, LLM s řídkou pozorností, který tvrdí zrychlení 9,7× a 15,6× při milionovém tokenovém značení oproti M2.5, což signalizuje, že efektivita při dlouhém kontextu, nikoli jen surová škála, je novým bojištěm čínských laboratoří.
FAQ
Je Qwen3.7-Max open source?
Ne. Qwen3.7-Max je proprietární a váhy nejsou zveřejněny. Je dostupný pouze přes Alibaba Cloud Model Studio, OpenRouter a Together AI. Starší modely rodiny Qwen 3.6 zůstávají open-weight na Hugging Face.
Kolik stojí Qwen3.7-Max?
API stojí $2.50 za 1 milion vstupních tokenů a $7.50 za 1 milion výstupních tokenů, se 90% slevou na kešovaný vstup za $0.25 za 1 milion.
Funguje Qwen3.7-Max s Claude Code?
Ano. Model nativně podporuje protokol Anthropic API, takže Claude Code, OpenClaw nebo jakýkoli harness kompatibilní s Anthropic můžete přímo namířit na endpoint Qwenu jako náhradu.
Je Qwen3.7-Max lepší než GPT-5.5?
Na Artificial Analysis Intelligence Index stále vede GPT-5.5 s 60,2 oproti Qwen3.7-Max s 56,6. Z hlediska poměru ceny a výkonu a u dlouhodobého agentového kódování je Qwen3.7-Max silnější volbou.
Jaký je rozdíl mezi Qwen3.7-Max a Qwen3.7-Plus-Preview?
Max je textový vlajkový uvažovací model s nejvyššími benchmarky a největším kontextem. Plus-Preview je multimodální (obrazový vstup) a cenově orientovaný pro objemnější pracovní postupy s nižšími nároky.