Aktualizováno 2. září 2026

Nejlepší AI modely v roce 2026

Žebříčky, srovnání a podrobné analýzy, každý měsíc aktualizované, jakmile vyjdou nové modely.

Claude Fable 5.1 dorazil 1. září a rovnou se postavil na vrchol Intelligence Index od Artificial Analysis se skóre 66, nejvyšším, jaké kdy tato firma naměřila, a vzal si s sebou i Agentic Index se skóre 61. Claude Opus 5 si drží to dvojí, podle čeho se čtenáři skutečně rozhodují: programátorskou korunu, získanou na obou hlasovacích žebříčcích Areny, a cenu, $5 / $25 za 1M tokenů proti $10 / $50 u Fable 5.1. Žádný žebříček Areny zatím nemá pro 5.1 hlasy, takže nic, o čem na této stránce rozhoduje lidská preference, se nepohnulo. Grok 4.6 je skutečným překvapením měsíce: dotrénování Grok 4.5 na stejném základu, které vyskočilo o pět bodů na 61, čímž se vyrovnal GPT-5.6 Sol, a to za $2 / $6, a dlouhé agentické úlohy dokončí zhruba na polovinu tahů, které potřebuje Opus 5.

Druhý posun se odehrává na levném konci a poprvé letos šel opačným směrem. DeepSeek 16. srpna zdražil oba modely V4 zhruba čtyřnásobně a rozdělil ceník na špičkové a mimošpičkové sazby, takže DeepSeek V4-Flash 0731 nyní stojí $0.22 / $0.66 mimo špičku a $0.44 / $1.32 ve špičce místo rovných $0.14 / $0.28, se kterými přišel, což jej stojí volbu s nejlepším poměrem cena/výkon. Ta přechází na GLM 5.3 Flash, který přišel 26. srpna s váhami pod MIT hned první den, s Intelligence Index 57 a ceníkovou sazbou $0.15 / $0.50, do 9. září sníženou na polovinu na $0.075 / $0.25, a který teď DeepSeek podbízí v kteroukoli denní hodinu. Google svůj Flash zlevnil na polovinu už dříve: Gemini 3.7 Flash vyšel 13. srpna za úvodních $0.75 / $3.75, se skóre 56 a prvním místem ze 182 modelů v rychlosti výstupu, přičemž Gemini 3.6 Flash přešel na stejnou sazbu. Obě ceny se 1. ledna 2027 zdvojnásobí. Otevřené pole pak měsíc uzavřelo třemi vydáními během tří dnů: GLM 5.3 konečně 28. srpna zveřejnil své váhy, byť pod vlastní licencí Z.ai místo čisté MIT, kterou dostal jeho menší sourozenec, Alibaba 26. srpna otevřela Qwen3.8-Flash-Next jako první veřejný pohled na architekturu Qwen4 a Tencent 28. srpna uvolnil Hy4 Preview, 770 miliard parametrů pod Apache 2.0. Níže jsou vítězové kategorií pro září 2026. Klikněte na kteroukoli kartu a přejdete rovnou k úplnému rozboru, nebo použijte pevnou navigaci k přeskakování mezi kategoriemi. Žebříčky, benchmarky a ceny aktualizujeme do 48 hodin od každého většího uvedení modelu.

Vítězové kategorií za září 2026
Psaní
Claude Fable 5
#1 Arena text (1508.6) a Arena tvůrčí psaní
Jediný model v první trojce všech tří nezávislých žebříčků pro psaní, za $10 / $50.
Podrobná analýza →
Chat & každodenní asistent
GPT-5.6
Výchozí model ChatGPT od 9. července
Nejlepší asistent, kterého většina lidí skutečně otevře, s vyvážením schopností, rychlosti a dosahu.
Podrobná analýza →
Obrázky
ChatGPT Images 2.0
#1 v generování obrázků z textu i v úpravách obrázků
Vede oba nezávislé žebříčky obrázků a stále nejlepší v čitelném vícejazyčném textu.
Podrobná analýza →
Video
Gemini Omni Flash
#1 na obou video žebříčcích (1527 Arena)
Vede oba nezávislé video žebříčky s konverzačními úpravami za zhruba $0.10 za sekundu.
Podrobná analýza →
Programování
Claude Opus 5
#1 Arena WebDev (1,702.9) za $5 / $25
Přebírá programátorskou korunu na hlasovacích žebříčcích, za poloviční cenu oproti Claude Fable 5.
Podrobná analýza →
Kreativita
Grok 4.6
Nejméně obsahových omezení + nativní X v reálném čase
Volba pro odvážnou, trendovou práci: nejméně mantinelů a nativní integrace X.
Podrobná analýza →
Přesnost & výzkum
Gemini 3.1 Pro
98 % ARC-AGI-1 za $0.52 na úlohu
Vyrovnává lidský panel na ARC-AGI-1 s nativním ukotvením ve vyhledávání Google pro živé odpovědi.
Podrobná analýza →
Řešení problémů
GPT-5.6 Sol
#1 LiveBench Mathematics, Reasoning a ARC-AGI-2
Nejlépe podložená koruna na této stránce pro nejtěžší matematiku, vědu a uvažování.
Podrobná analýza →
AI agenti
Gemini Spark
První AI agent běžící v cloudu 24/7
Běží nepřetržitě v Google Cloud VM, hluboce integrovaný s Gmailem, Docs a Chromem.
Podrobná analýza →

Chcete špičkové AI modely bez žonglování se samostatnými předplatnými? Fello AI spojuje přední modely v jedné nativní aplikaci pro Mac, iPhone a iPad.

Stáhnout Fello AI
Co je nového v září 2026
1. zář. Anthropic Claude Fable 5.1 a Mythos 5.1, nová #1 na Artificial Analysis se skóre 66 a snížení ceny čtení z cache o 75 % Nové
Anthropic vydal Claude Fable 5.1 a Claude Mythos 5.1 dne 1. září 2026 a jde o jeden model ve dvou konfiguracích bezpečnostních pojistek, nikoli o dva modely. Fable 5.1 je obecně dostupný; Mythos 5.1 uvolňuje omezení v biologii a kybernetické bezpečnosti a rozdává se na pozvání, bez zveřejněných kritérií způsobilosti. Artificial Analysis hodnotí Fable 5.1 na 66 na svém Intelligence Index v4.1.1 při nastavení max effort, což je nejvyšší skóre, jaké kdy naměřil, před Claude Opus 5 se skóre 63, Claude Fable 5 se skóre 62 a GPT-5.6 Sol a Grok 4.6 se skóre 61. Bere si také Agentic Index se skóre 61 proti 59 u Opus 5, žebříček GDPval-AA v2 pro profesionální výstupy se skóre 1853 proti 1824 a Humanity's Last Exam se skóre 59,1 % proti 55,5 % u Fable 5. Nastavení effort zde hraje větší roli než obvykle: tentýž model čte 58 při low, 60 při medium, 62 při high a 65 při xhigh a tato nastavení pokrývají jedenáctinásobný rozdíl ve výstupních tokenech, od 13,1 milionu do 143,7 milionu napříč celou sadou. Ceny zůstávají nezměněné na $10 / $50 za 1M tokenů, ale čtení z cache klesá o 75 % na $0.25 z $1.00 u Fable 5, a právě tam u dlouhých agentických běhů leží skutečná úspora. Na vlastních číslech Anthropicu dosahuje 52,6 % na Terminal-Bench-Science 0.1 proti 29,0 % u Opus 5 a 212stránková systémová karta zvýšila vlastní hodnocení rizika sladění společnosti z velmi nízkého na nízké. Dvě věci zvažte, než přejdete: Anthropic stále doporučuje začít s Opus 5 pro většinu zátěží za poloviční cenu a žádný žebříček Areny nemá hlasy ani pro jeden z těchto modelů, takže nic, co na této stránce spočívá na lidských preferencích, se nepohnulo. Úplné podrobnosti najdete v našem rozboru Claude Fable 5.1 a Mythos 5.1.
28. srp. Z.ai Váhy GLM 5.3 jsou venku po bezpečnostní pauze, ale licence není MIT Nové
Z.ai zveřejnilo váhy GLM 5.3 na Hugging Face 28. srpna 2026, dva týdny po spuštění API a přesně k datu, které neslo zástupné místo, takže slíbené bezpečnostní vyhodnocení skutečně proběhlo a pauza je uzavřená, ne otevřená. Co se změnilo, je licence. GLM 5.3 Flash vyšel o dva dny dříve pod čistou MIT; vlajková loď nese vlastní dokument nazvaný GLM 5.3 License a pole licence v kartě modelu uvádí glm-5.3, nikoli mit. Samotné udělení práv MIT těsně sleduje, s právem model provozovat, nasazovat, dotrénovat, upravovat, šířit i prodávat a s váhami výslovně zahrnutými do definice softwaru, takže komerční užití je otevřené téměř všem. Jedna klauzule je skutečně nová: provozovatel model-as-a-service, jehož tržby přesáhnou 10 miliard dolarů za jakýchkoli dvanáct po sobě jdoucích měsíců, musí před komerčním nasazením projít bezpečnostní revizí Z.ai, přičemž rozsah a metodu té revize si Z.ai vyhrazuje určit samo. Všimněte si také, že Hugging Face počítá zveřejněný checkpoint na 753B parametrů proti základu 744B, který podle Z.ai sdílí s GLM-5.2; to je typ rozdílu, jaký vzniká mechanickým počítáním parametrů, nikoli doklad jiného modelu. Naši open-weight volbu to neposouvá. GLM 5.3 Flash zůstává modelem, který bychom hostovali, protože 320B pod čistou MIT se provozuje i právně ošetřuje výrazně snáz než 753B pod vlastní licencí. Podrobnosti v našem rozboru GLM 5.3.
28. srp. Tencent Tencent Hy4 Preview, 770B otevřených vah pod Apache 2.0 a zatím největší permisivně licencovaný model Nové
Tencent vydal a uvolnil Hy4 preview 28. srpna 2026, novou vlajkovou loď řady Hunyuan a největší model, jaký kdy kdo zveřejnil pod Apache 2.0. Běží na 770 miliardách parametrů celkem se 49 miliardami aktivních na token v architektuře mixture-of-experts, přijímá kontextové okno, které Tencent popisuje jako přesahující 1M tokenů, a vedle plné přesnosti vychází i ve variantě FP8. Ceny API jsou $0.834 za 1M vstupních tokenů, $2.501 za výstupní a $0.042 za kešovaný vstup, což je na tuto velikost levné. Skutečnou zprávou je licence: Apache 2.0 je permisivnější než vlastní dokument u Kimi K3 i než licence, kterou Z.ai téhož dne připojilo ke GLM 5.3. S tvrzením o kvalitě zacházejte opatrně, protože jediným dosavadním důkazem je dodavatelův vlastní. Tencent provedl interní slepé hodnocení 203 inženýrských úloh, které bodovalo 163 expertů, a Hy4 preview v něm získává 2,99 ze 4,00 proti 2,94 u Kimi K3 a 2,92 u GLM 5.3. To je vlastní panel Tencentu, rozdíly se vejdou do jedné desetiny bodu a žádná nezávislá firma pro model zatím nezveřejnila Intelligence Index ani hodnocení Areny, takže jej uvádíme, nikoli řadíme. Tencent rovněž tvrdí, že model pomohl automatizovat optimalizaci vlastního trénovacího procesu a zvýšil vlastní propustnost inference o naměřených 31,8 %. Je dostupný jako otevřené váhy a přes WorkBuddy, CodeBuddy, Yuanbao a ima, dále přes Tencent Cloud TokenHub a OpenRouter, s bezplatným přístupem na WorkBuddy a CodeBuddy po dobu dvou týdnů od uvedení.
26. srp. Z.ai GLM 5.3 Flash, odhalení Ox Alpha a první váhy pod MIT, které Z.ai vydalo od GLM-5.2 Nové
Z.ai vydalo GLM 5.3 Flash 26. srpna 2026 a není to model, na který se čekalo. Váhy zadržené 14. srpna patří GLM 5.3; tohle je samostatný model na nově natrénovaném základu, 320 miliard parametrů s 18 miliardami aktivních, první nativně multimodální model řady GLM-5, a na Hugging Face pod licencí MIT se objevil týž den. Je to zároveň onen utajený model, který obsluhoval provoz na OpenRouteru pod jménem Ox Alpha a během té ukázky běžel výhradně na čínských AI čipech, což popisuje způsob provozu, nikoli způsob trénování. Artificial Analysis mu dává 57 bodů na Intelligence Index v4.1.1, o čtyři body více než GLM-5.2 při méně než poloviční velikosti, a řadí jej na Paretovu hranici poměru inteligence a ceny, zhruba na $0.09 za jednu úlohu indexu. Ceníková sazba je $0.15 / $0.50 za 1M tokenů s padesátiprocentní uváděcí slevou do 24:00 dne 9. září a po zdražení DeepSeeku ze 16. srpna tato ceníková sazba podbízí DeepSeek V4-Flash 0731 v kteroukoli denní hodinu. S čísly pro programování a agentní práci zacházejte opatrně: pocházejí z vlastního grafu Z.ai, který si jako srovnání bere Claude Opus 4.8 a GPT-5.6 Terra místo současných lídrů, a stojí v něm Terminal Bench 2.1 84,3, DeepSWE v1.1 63,4 proti 46,2 u GLM-5.2 a AutomationBench 48,8. Jediné číslo v tom grafu, které měřila Artificial Analysis, je GDPval-AA v2, kde GLM 5.3 Flash dosahuje 1773 Elo, nejvíce ze všech vynesených modelů. Hlasy v Areně zatím žádné nejsou. Naši open-weight volbu to mění: GLM 5.3 Flash nahrazuje GLM-5.2 jako model pod MIT, který bychom hostovali. Jedna výstraha k hardwaru: 18B aktivních neznamená 18B k hostování, protože směrování mixture-of-experts potřebuje mít všech 320B vah v paměti, takže jde o multi-GPU server, ne o pracovní stanici. Podrobnosti v našem rozboru GLM 5.3 Flash.
26. srp. Alibaba Qwen3.8-Flash-Next, otevřené váhy a první veřejný pohled na architekturu Qwen4 Nové
Alibaba zveřejnila Qwen3.8-Flash-Next na Hugging Face 26. srpna 2026 a jde v něm spíš o architekturu než o žebříčky: Qwen uvádí, že je to raný pohled na návrh, který použije rodina Qwen4, vydaný proto, aby se na něj komunita mohla připravit. Je to mixture-of-experts se 125 miliardami parametrů a pouhými 6 miliardami aktivních na token, plus samostatné N-gramové embedding s 51 miliardami parametrů, a přijímá text, obraz i video. Kontext je nativně 262 144 tokenů s rozšířením na 1M. Mezi zveřejněnými čísly Qwenu je 91,7 na GPQA Diamond, 62,5 na SWE-Bench Pro, 58,7 na DeepSWE 1.1, 81,0 na SWE-Bench Multilingual a 84,5 na AndroidWorld vision, vše dodavatelovo, zatím bez nezávislého Intelligence Indexu a bez hlasů na Areně. Licenci je třeba si přečíst dřív, než na ní začnete stavět, protože to není Apache. Qwen Community License 1.0 povoluje komerční užití, úpravy i hostování, ale vyžaduje viditelné uvedení názvu modelu, jakmile produkt překročí 100 milionů měsíčních aktivních uživatelů nebo 20 milionů dolarů měsíčních tržeb, a vyžaduje samostatnou licenci od Qwenu pro provozování model-as-a-service nebo produktu typu AI pracovní asistent. Interní použití je z této druhé podmínky vyňato.
21. srp. OpenAI GPT-5.6 Sol zlevnil o více než 20 %, nyní je pod Claude Opus 5 na obou stranách Nové
OpenAI dne 21. srpna 2026 snížil cenu GPT-5.6 Sol z $5 / $30 na $4 / $20 za 1M tokenů, což je první zlevnění vlajkového modelu od červencového uvedení rodiny GPT-5.6. Sazba je propagační a podle OpenAI potrvá zhruba tři měsíce. Týká se API a kreditů pro Codex a ChatGPT Work; ceny předplatného Plus, Pro a Business se nemění. Za $4 / $20 nyní Sol podráží Claude Opus 5 za $5 / $25 ve vstupu i výstupu, poprvé je tedy vlajkový model OpenAI z těch dvou levnější.
16. srp. DeepSeek DeepSeek zdražuje API zhruba čtyřnásobně a dělí ceník na špičku a mimo špičku Nové
DeepSeek převedl oba modely V4 na nový ceník v 16:00 UTC dne 16. srpna 2026 a směr je pro tento obor nezvyklý: ceny šly nahoru, ve špičce zhruba čtyřnásobně. V4-Flash 0731 šel z rovných $0.14 / $0.28 za 1M tokenů na $0.22 / $0.66 mimo špičku a $0.44 / $1.32 ve špičce a V4-Pro 0813 z $0.435 / $0.87 na $0.66 / $1.98 mimo špičku a $1.32 / $3.96 ve špičce, s kešovaným vstupem na $0.007, respektive $0.022 mimo špičku. Špička je od 01:00 do 04:00 a od 06:00 do 10:00 UTC od pondělí do pátku a každá jiná hodina je mimo špičku, přesně za polovinu špičkové sazby. DeepSeek to podal jako rozumnější rozdělení kapacity. Na samotných modelech se nic nezměnilo, takže jde čistě o ekonomickou událost, ale pro tuto stránku o zásadní: stojí DeepSeek V4-Flash volbu s nejlepším poměrem cena/výkon, která přechází na GLM 5.3 Flash s ceníkovými $0.15 / $0.50, což podbízí i tu levnější mimošpičkovou sazbu DeepSeeku v kteroukoli denní hodinu. Váhy zůstávají pod MIT, takže kdo si model hostí sám, se změny nedotkne. Podrobnosti v našem rozboru DeepSeek V4.
14. srp. Z.ai GLM 5.3, velký agentický skok jen z dotrénování, vyšel bez open weights Nové
Z.ai vydalo GLM 5.3 dne 14. srpna 2026 a pozoruhodné je to, co se nezměnilo: běží na stejném základu se 744 miliardami parametrů jako GLM-5.2, bez nového předtrénování. Veškerý nárůst pochází ze škálovaného dotrénování a ten agentický je velký. Na vlastním grafu Z.ai jde Terminal-Bench 3.0 z 4,6 na 28,3, DeepSWE v1.1 ze 46,2 na 66,9 a CyberGym ze 77,2 % na 84,5 %, o čemž firma tvrdí, že těsně předčí Claude Mythos 5 s 83,8 a GPT-5.6 Sol s 83,6. Všechna tato čísla jsou dodavatelova, zatím bez nezávislého auditu, a graf je jinde méně lichotivý: na interním Code Bench od Z.ai stále vede Claude Fable 5 s 39,5 % proti 31,4 % u GLM 5.3 a na ExploitBench jsou lídři frontier na 78,0 % proti 54,4 %. Háček je v licenci, nikoli ve skóre. GLM-5.2 vydal váhy pod MIT během několika dnů; GLM 5.3 nevyšel s žádnými a Z.ai uvedlo, že budou následovat po bezpečnostním vyhodnocení schopnosti modelu vyhledávat zranitelnosti, zhruba za dva týdny. To se vyřešilo 28. srpna 2026, kdy Z.ai zveřejnilo váhy přesně k datu, které zástupná stránka nesla, byť pod vlastní licencí GLM 5.3 License místo čisté MIT, kterou dostaly GLM-5.2 i GLM 5.3 Flash. Sazba za token je nyní zveřejněná, $1.40 / $4.40 za 1M tokenů, vedle GLM Coding Planu a ZCode. To, co dorazilo 26. srpna, byl místo toho GLM 5.3 Flash, jiný a menší model, který váhy pod MIT vydal, a právě to je vydání, které posunulo naši open-weight volbu. Podrobnosti v našem rozboru GLM 5.3.
13. srp. Google Gemini 3.7 Flash, programátorské skóre roste a cena klesá na polovinu na $0.75 / $3.75, do ledna Nové
Google vydal Gemini 3.7 Flash 13. srpna 2026, 23 dní po 3.6 Flash a jako třetí vydání Flash za necelé dva měsíce, zatímco Gemini 3.5 Pro stále nevyšel. Podstatou jsou programátorské zisky: DeepSWE v1.1 stoupá ze 49,0 % na 65,3 %, FrontierCode 1.1 Main z 34,4 % na 43,6 % a AutomationBench se téměř zdvojnásobuje ze 17,0 % na 30,4 %. Artificial Analysis jej hodnotí na 56 na svém indexu v4.1.1 proti 52 u 3.6 Flash a řadí jej na první místo ze 182 modelů v rychlosti výstupu s 385,1 tokenu za sekundu, což jej staví na Paretovu hranici inteligence versus čas. Kontextové okno a limit výstupu 64K jsou proti 3.6 Flash nezměněné, takže se nic neobětovalo. Dvě výhrady váží víc než benchmarky. Sazba $0.75 / $3.75 je úvodní a vyprší 31. prosince 2026, poté se zdvojnásobí na $1.50 / $7.50, přesně na to, co stál 3.6 Flash při uvedení; Google zároveň převedl 3.6 Flash na stejnou sazbu, takže oba nyní stojí stejně a upgrade je čistě rozhodnutí o schopnostech. A spotřebitelský přístup vede jen přes Spark, který vyžaduje Google AI Pro nebo Ultra a vylučuje Evropský hospodářský prostor, Spojené království, Švýcarsko a Nigérii, takže většina evropských čtenářů se k němu v aplikaci Gemini vůbec nedostane. Bezplatná úroveň Gemini stále dostává 3.6 Flash. Přístup přes API je všude nedotčen. Podrobnosti v našem rozboru Gemini 3.7 Flash.
12. srp. SpaceXAI Grok 4.6, dotrénování zvedá Intelligence Index z 56 na 61 při nezměněných $2 / $6 Nové
SpaceXAI vydala Grok 4.6 dne 12. srpna 2026 a výslovně nejde o nový základový model: společnost ponechala základ z Grok 4.5 a zlepšení koupila delším doplňkovým tréninkem, přegenerovanými trajektoriemi pro doladění a posilovaným učením v agentických prostředích. Žádná nová architektura ani počet parametrů zveřejněny nebyly. Artificial Analysis jej řadí na Intelligence Index 61, pět bodů nad Grok 4.5, což jej staví na sdílené třetí místo s GPT-5.6 Sol, za Claude Opus 5 se skóre 63 a Claude Fable 5 se skóre 62, jak index vypadal v tom měsíci; Claude Fable 5.1 se od té doby dostal nad všechny tři se skóre 66. Agentické hodnoty jsou silnější než souhrnný index: Elo 1753 na GDPval-AA v2 hned za Opus 5, 88,4 % na Terminal-Bench v2.1 a 50,7 % na tau3-Banking. Skutečným argumentem je efektivita, $0.84 na indexovou úlohu a zhruba 53 tahů a 0,5 miliardy vstupních tokenů u dlouhých úloh proti přibližně 103 tahům a 2,0 miliardám u Opus 5. Ceny zůstávají nezměněné na $2 / $6 za 1M tokenů s cache input za $0.50, na stejném kontextovém okně 500K tokenů, ale je tu past, kterou je dobré znát: jakmile prompt dosáhne 200 000 tokenů, SpaceXAI přeúčtuje celý požadavek sazbou $4 / $12, nikoli jen to, co limit přesahuje. Jedno varování k benchmarkům, protože řada článků to už popletla: Terminal-Bench v3.0 je jiný a mnohem těžší test než v2.1, takže 26 % na v3.0 a 88,4 % na v2.1 jsou obě pravdivá tvrzení o tomtéž modelu. Od prvního dne běží v API SpaceXAI, v Cursoru a Grok Build a u partnerů OpenRouter, Vercel a Cloudflare. Úplné podrobnosti najdete v našem rozboru benchmarků a cen Grok 4.6.
5. srp. Meta Muse Spark 1.2 a Muse Code, Intelligence Index z 51 na 57 při nezměněných $1.25 / $4.25, plus terminálový programátorský agent Nové
Meta vydala Muse Spark 1.2 dne 5. srpna 2026 spolu s Muse Code, svým prvním terminálovým programátorským agentem, který běží na macOS a Linuxu bez desktopové aplikace a bez předplatného. Artificial Analysis hodnotí model na Intelligence Index 57 při nejvyšším nastavení uvažování na svém aktuálním indexu v4.1.1, oproti 51 u verze 1.1 a 43 u dubnového vydání, a téměř celý tento nárůst je agentický, nikoli obecné znalosti; jeho GDPval-AA v2 Elo skočilo z 1371 na 1631, zatímco Terminal-Bench v2.1 se posunul jen z 78 % na 80 %. Ceny zůstávají nezměněny na $1.25 / $4.25 za 1M tokenů při kontextovém okně 1M tokenů a Meta přidala úroveň Contributor za $0.10 / $0.20, zhruba o 92 % levněji, výměnou za to, že Meta smí trénovat na vašich promptech a completions. Dostupnost se rozšířila z náhledu pouze pro USA, pod nímž vyšla verze 1.1, na rozšířený globální přístup přes Muse Code, Meta Model API a OpenRouter. Na vlastních uváděcích grafech Mety končí model druhý za Claude Opus 5 na všech třech zveřejněných programátorských benchmarcích, se skóre 82,9 % proti 86,7 % na Terminal-Bench 2.1.
3. srp. Alibaba Qwen 3.8 (Qwen3.8-Max), multimodální vlajkový model s 2,4 biliony parametrů nyní obecně dostupný za $2 / $6 Nové
Alibaba zpřístupnila Qwen3.8-Max obecně dne 3. srpna 2026, dva týdny po náhledu na WAIC Shanghai, a každé číslo, které při náhledu chybělo, má nyní hodnotu. Běží s 2,4 biliony celkových parametrů a zhruba 95 miliardami aktivních na token na řídkém návrhu Mixture-of-Experts, přijímá text, obrázky a video a potvrzuje kontextové okno 1M tokenů s až 128K výstupními tokeny. Ceny API jsou $2 / $6 za 1M tokenů, ploché napříč celým kontextem místo odstupňování podle délky promptu, s cache reads za $0.25. Tvrzení „druhý hned za Fable 5“ se nyní čistě rozpadá na dvě části: na žebříčku vision Areny je #2 se skóre 1305, hned za Fable 5, ale na textovém žebříčku je #5 se skóre 1496, za čtyřmi záznamy Anthropicu. Obě skóre Areny jsou stále označena jako předběžná a slíbené open weights nevyšly. Qwen 3.8 držíme mimo hodnocené volby, dokud váhy a licence skutečně nedorazí.
31. čvc. DeepSeek DeepSeek V4-Flash 0731, stejná cena, stejná velikost, Intelligence Index z 40 na 52
DeepSeek znovu dotrénoval V4-Flash a výsledek zveřejnil 31. července 2026 jako DeepSeek-V4-Flash-0731. Na tvaru modelu se nic nezměnilo: je to stejný Mixture-of-Experts s 284B celkem / 13B aktivními, stejný kontext 1M tokenů, stejná licence MIT a tehdy i stejných $0.14 / $0.28 za 1M tokenů na vlastním ceníku DeepSeeku. To poslední měsíc nepřežilo: DeepSeek 16. srpna zdražil oba modely V4 zhruba čtyřnásobně a rozdělil je na špičkové a mimošpičkové sazby. Co se pohnulo, jsou schopnosti. Artificial Analysis jej nyní hodnotí na Intelligence Index 52 na svém indexu v4.1.1, oproti 40 před dotrénováním, s Agentic 45,7 a 78,7 % na Terminal-Bench v2.1, což jej zvedá zhruba ze třináctého na třetí místo v otevřeném poli za Kimi K3 a GLM-5.2. Artificial Analysis jej měřila na $0.11 na indexovou úlohu proti $2.34 u Claude Opus 5, což mu tehdy vyneslo volbu s nejlepším poměrem cena/výkon; zdražení ze 16. srpna jej o ni od té doby připravilo. Tento údaj je měřen proti koncovému bodu, který Artificial Analysis testuje a který je dražší než vlastní ceník DeepSeeku. Jedno upřímné omezení: skóre pochází od jediné firmy a model zatím nemá hlasy na žádném žebříčku Areny.
31. čvc. MiniMax MiniMax H3, 2K video s nativním stereo zvukem od $0.13 za sekundu
MiniMax uvedl H3 (Hailuo 3.0) dne 31. července 2026 jako univerzální multimodální video model, který přijímá text, obrázek, video a zvuk jako vstup. Vydává 2K klipy o délce 4 až 15 sekund s nativním stereo zvukem, podporuje přenos pohybu, generování řízené referencí a generativní úpravy videa a účtuje se za sekundu za $0.13 pro 2K a $0.09 pro 768p. Artificial Analysis jej řadí na #2 na svém video žebříčku se skóre 1241,5, o 3,3 Elo za Gemini Omni Flash. Video korunu jsme ponechali tam, kde je: ten odstup je den starý a pochází od jediného žebříčku, který se mezi analýzami nereprodukoval, a hranice Areny pro generování videa z textu předchází H3 celá, takže na hlasech nic neporazil. MiniMax zveřejnil váhy 3. srpna 2026, ale jen zčásti: H3-Base spolu s VAE a enkodérem vyšly na Hugging Face pod licencí MiniMax H3 Community License, která vyžaduje žádost od uživatelů z USA, EU, Spojeného království a Jižní Koreje, zatímco H3-Context-IR a upscaler H3-Regenerate-2K zůstaly jen v API. Výstup 2K, na kterém model stojí, tedy v otevřeném vydání není.
Konec čvc. Thinking Machines Inkling Small, čtvrtina velikosti Inkling při téměř stejném skóre
Thinking Machines navázali na svůj první open-weight model modelem Inkling Small, Mixture-of-Experts s 276B celkem / 12B aktivními pod Apache 2.0, který směruje každý token k 6 z 256 expertů plus 2 sdíleným. Přijímá text, obrázek a zvuk na vstupu a vrací text a Artificial Analysis jej hodnotí na Intelligence Index 40 proti 41 pro plnohodnotný Inkling, při zhruba čtvrtině parametrů. Zdroje se neshodují na přesném datu vydání, takže žádné neuvádíme. Váhy, sestavení NVFP4 a recepty na nasazení jsou všechny na Hugging Face.
30. čvc. OpenAI Snížení cen GPT-5.6, Luna o 80 % levnější, Terra o 20 % levnější, Sol beze změny
OpenAI snížil 30. července 2026 cenu API u svých dvou levnějších úrovní GPT-5.6, tři týdny poté, co rodina dosáhla obecné dostupnosti. Luna klesla o 80 % na $0.20 / $1.20 za 1M tokenů a Terra klesla o 20 % na $2 / $12, přičemž cache input reads klesly na $0.02 u Luny a $0.20 u Terry. Vlajkový Sol zůstal na $5 / $30, prompty nad 272K vstupních tokenů se stále účtují za 2násobek vstupu a 1,5násobek výstupu a žádná cena předplatného ChatGPT se nezměnila, takže Free, Go za $8, Plus za $20, Pro za $100 a $200 a Business za $25-30 na místo zůstávají všechny beze změny. Snížení nechává Lunu na Intelligence Index 52 na indexu v4.1.1 od Artificial Analysis za zhruba $0.05 na indexovou úlohu, na stejné úrovni jako Gemini 3.6 Flash ve skóre a hluboko pod ním v ceně.
24. čvc. Anthropic Claude Opus 5, nová #1 na Artificial Analysis, vede jak Intelligence Index (63), tak Agentic Index (55.3)
Anthropic vydal Claude Opus 5 dne 24. července 2026, svůj čtvrtý model za necelé dva měsíce po Mythos 5, Fable 5 a Sonnet 5. Na žebříčku od Artificial Analysis je celkově nejlépe hodnoceným modelem, vede jak Intelligence Index se skóre 63, tak Agentic Index se skóre 55,3, před Fable 5 (62 / 52,8) a GPT-5.6 Sol (61 / 54,0). Ceny API jsou $5 / $25 za 1M tokenů, shodné s Opus 4.8 a poloviční oproti Fable 5, pod API id claude-opus-5. Přidává režim Fast, který běží zhruba 2,5krát rychleji za dvojnásobek základní ceny, plus nastavení effort od low do high a novou úroveň max. Bere si také naprosto žebříček GDPval-AA v2 pro profesionální výstupy od Artificial Analysis se skóre 1858, před 1746 od Fable 5. Arena jej od té doby ohodnotila napříč svými žebříčky a řadí jej na #1 ve WebDev, image-to-WebDev, Document a na žebříčku Agent a na #6 v textu, což mu tento měsíc přisoudilo programátorskou korunu. Je výchozím modelem v Claude Max a nejsilnější v Claude Pro. Pozor, tvrzení o vedení výše bylo mezitím překonáno: Claude Fable 5.1 dorazil 1. září 2026 a vzal si Intelligence Index se skóre 66 a Agentic Index se skóre 61 proti 63 a 59 u Opus 5 podle aktuálního čtení, a s nimi i žebříček GDPval-AA v2, kde přepočítané Elo staví Fable 5.1 na 1853 proti 1824 u Opus 5. Opus 5 si drží oba programátorské žebříčky Areny a stojí polovinu.
24. čvc. Sakana AI Fugu-Ultra v1.1, obnova orchestrační engine se zlepšeními hlášenými dodavatelem až o 7,9 bodu oproti v1.0 za stejnou cenu
Sakana AI dodala Fugu-Ultra v1.1 dne 24. července 2026, obnovu frontier modelů uvnitř své orchestrační engine TRINITY, nikoli nový základní model. Vlastní oznámení Sakany tvrdí zlepšení až o 7,9 bodu oproti v1.0 při nezměněné ceně, ale skóre v1.0 vedle toho nezveřejňuje, takže to berte jako údaj dodavatele. Všechna čísla benchmarků pocházejí z vlastního scaffoldingu Sakany, nikoli z nezávislého testování: na vlastních grafech vede před Opus 4.8, GPT-5.5 a Gemini 3.1 Pro, se skóre 73,7 % na SWE-Bench Pro, 82,1 % na Terminal-Bench 2.1, 93,2 % na LiveCodeBench a 95,5 na GPQA-Diamond. Pole ale nezametá: jeho 50,0 na Humanity's Last Exam je remíza v rámci zaokrouhlení s 49,8 u Opus 4.8. Cena je nezměněná oproti v1.0 na $5 / $30 za 1M vstupních/výstupních tokenů (plus $0.50 cached) a stoupá na $10 / $45 nad hranicí kontextu 272K tokenů; API je kompatibilní s OpenAI s kontextovým oknem 1M tokenů.
21. čvc. Google Gemini 3.6 Flash, levnější výstup, rychlejší, stejný Intelligence Index
Gemini 3.6 Flash byl při uvedení nejnovějším modelem Flash od Googlu a stále je tím, k němuž dosáhne bezplatná aplikace Gemini. Výstup klesá na $7.50 za 1M tokenů z $9.00, zatímco vstup zůstává na $1.50, takže snížení je pouze na výstupu. Google říká, že „snižuje spotřebu výstupních tokenů o 17 % oproti 3.5 Flash“ a až o 65 % u dlouhodobé agentické práce jako DeepSWE, takže reálná úspora na úlohu je větší než cenovka. Artificial Analysis hodnotil 3.6 Flash i 3.5 Flash stejně na v4.1, takže při uvedení šlo o levnější a rychlejší, nikoli chytřejší model; na aktuálním indexu v4.1.1 má 3.6 Flash 52. Vyšel spolu s Gemini 3.5 Flash-Lite za $0.30 / $2.50 a je živý přes Gemini API v Google AI Studio a Android Studio, na Gemini Enterprise Agent Platform a v aplikaci Gemini pro všechny. Pozor, výše uvedené uváděcí ceny už neplatí: když 13. srpna dorazil Gemini 3.7 Flash, Google převedl 3.6 Flash na stejnou úvodní sazbu $0.75 / $3.75 a zůstává modelem, který dostává bezplatná úroveň Gemini. Google také oznámil Gemini 3.5 Flash Cyber, ale ten nevyšel: míří přes CodeMender jako pilot s omezeným přístupem k vládám a důvěryhodným partnerům.
16. čvc. Moonshot AI Kimi K3, 2,8B parametrů, největší kdy vydaný open-weight model (váhy vyšly 27. července)
Moonshot AI uvedl Kimi K3 v předvečer 16. července 2026, svůj nový vlajkový model a nástupce řady K2, a poté 27. července 2026 zveřejnil kompletní open weights. Karta modelu na Hugging Face potvrzuje návrh Mixture-of-Experts s 2,8 biliony parametrů, 104 miliardami aktivních na token, kontextovým oknem 1 048 576 tokenů a vstupem textu, obrázku a videa (bez zvuku). Uvažování je vždy zapnuté a reasoning_effort nyní přijímá low, high nebo max, s max jako výchozí hodnotou. Artificial Analysis řadí K3 na Intelligence Index 60, nejvyšší ze všech open-weight modelů, a na Areně je #3 na žebříčku Agent a #2 ve WebDev za Claude Opus 5. Oficiální ceny API jsou $3 / $15 za 1M tokenů s cache input za $0.30, plus $0.005 za každé úspěšné volání vyhledávání na webu. Ke stažení je 96 shardů safetensors a zhruba 1,56 TB pod vlastní licencí Kimi K3 License místo MIT, takže self-hosting je vícenodová záležitost; bezplatná základní chatovací úroveň existuje v aplikaci Kimi, přičemž náročnější agentické použití je měřeno na placených plánech.
9. čvc. OpenAI GPT-5.6 Sol, Terra a Luna, rodina nové generace živá napříč ChatGPT, Codex a API
OpenAI otevřel svou rodinu GPT-5.6 obecné dostupnosti dne 9. července 2026 a ukončil tím dvoutýdenní uzavřený náhled, který začal 26. června za bezpečnostní prověrkou vlády USA. Řada sahá od nejméně po nejschopnější: Luna, rychlá a nízkonákladová úroveň; Terra, vyvážený každodenní model, o němž OpenAI říká, že se vyrovná GPT-5.5 zhruba za poloviční cenu; a Sol, vlajkový model laděný pro biologii, chemii a kyberbezpečnost. GPT-5.6 se nyní zavádí napříč ChatGPT, Codex a API jako výchozí model OpenAI, s uváděcími cenami API Sol $5 / $30, Terra $2.50 / $15 a Luna $1 / $6 za 1M tokenů; Terra a Luna byly 30. července 2026 sníženy na $2 / $12 a $0.20 / $1.20 a samotný Sol byl 21. srpna 2026 snížen na $4 / $20. Na těch několika benchmarcích, které OpenAI zveřejnil, Sol dosahuje 88,8 % na Terminal-Bench 2.1 (91,9 % ve výpočetně náročnějším režimu „ultra“) oproti 88,0 % u GPT-5.5 a 60,5 na HealthBench Professional; OpenAI nápadně zadržel obvyklá čísla SWE-bench Verified, GPQA a FrontierMath a jeho kontextové okno stále není oficiálně zveřejněno. Jedna výhrada: vlastní system card OpenAI a externí hodnotitel METR upozornili na zvýšené chování „scheming“ u Sol, včetně obcházení softwarově-inženýrského testu nejvyšší mírou, jakou kdy METR zaznamenal.
Čeká se Google Gemini 3.5 Pro, stále nevydaný, měsíce za plánem podle Bloombergu Zpožděno
Gemini 3.5 Pro zůstává největším čekajícím uvedením. Google jej oznámil na I/O dne 19. května spolu s Gemini 3.5 Flash, ale vyšel jen Flash a červnový cíl padl. Bloomberg 16. července 2026 informoval, že model je měsíce za plánem a nedosáhl interních cílů Googlu, přičemž společnost stále pracuje na zlepšení jeho schopností zejména v programování. To je celý podložený obraz. Google nikdy veřejně nepotvrdil datum uvedení a Google nezveřejnil finální specifikace jako kontextové okno nebo režimy uvažování, takže kolující čísla berte jako nepotvrzená. Mezitím používejte Gemini 3.7 Flash, pokud pracujete přes API, nebo Gemini 3.6 Flash, pokud jste na bezplatné aplikaci Gemini, která jej stále používá; 3.5 Pro přesuneme do hlavního žebříčku ve chvíli, kdy vyjde.
Volba kategorie, září 2026

Nejlepší AI na psaní

1
Claude Fable 5
Nejlepší psaní celkově
2
Kimi K3
Tvůrčí beletrie
3
Claude Sonnet 5
Zdarma na každý den

Nejlepší AI na psaní je Claude Fable 5, jediný model v první trojce všech tří nezávislých žebříčků pro psaní, s Claude Sonnet 5 jako volbou s nejlepším poměrem cena/výkon v bezplatné verzi a GPT-5.5 jako alternativou pro faktograficky ukotvené obchodní psaní. Fable 5 vede žebříček tvůrčího psaní Areny, kraluje LiveBench Language se skóre 90,7 a je třetí na EQ-Bench Creative Writing v3 za Kimi K3 a GPT-5.6 Sol. Žádný jiný model není v první trojce na více než jednom z nich. Je to změna oproti minulému měsíci, kdy tuto pozici držel Claude Sonnet 5 na GDPval-AA; preferenční žebříčky toto umístění nepodporují, takže Sonnet 5 je nyní volba s nejlepším poměrem cena/výkon, nikoli lídr kvality. Fable 5 stojí $10 / $50 za 1M tokenů a je trvale zahrnutý v Claude Max a Team Premium zhruba na 50 % běžných limitů použití. Pokud je vaše psaní pracovní výstup, a ne próza, žebříčku GDPval-AA v2 pro profesionální výstupy nyní vládne Claude Fable 5.1 se skóre 1853, před Claude Opus 5 se skóre 1824 a Fable 5 se skóre 1723. Fable 5.1 dorazil 1. září jako schopnější model za stejných $10 / $50 a poráží Fable 5 na každém žebříčku, který změřil oba, včetně Humanity's Last Exam se skóre 59,1 % proti 55,5 %. Korunu jsme na něj nepřesunuli, protože tato volba spočívá na lidské preferenci a žádný žebříček Areny jej zatím neohodnotil. Překlad je samostatná otázka se samostatným vítězem, které se věnujeme v průvodci nejlepší AI na překlad.

ModelNejlepší proSilná stránkaSlabinaCena (za 1M tokenů)
Claude Fable 5Nejlepší psaní celkově#1 Arena text celkově (1508.6), #1 LiveBench Language (90.7), #3 EQ-BenchNejdražší volba zde$10 / $50
Claude Fable 5.1Nejvyšší schopnosti za stejnou cenu#1 Humanity's Last Exam (59,1 %), #1 GDPval-AA v2 (1853), #1 Intelligence Index (66)Zatím žádné hlasy v Areně, takže na preferenčních žebříčcích neohodnocen$10 / $50
Kimi K3Tvůrčí beletrie a hlas#1 EQ-Bench Creative Writing (2377), 234 Elo náskok před druhýmJen #10 na Arena tvůrčí psaní$3 / $15
Claude Sonnet 5Bezplatné psaní na každý denZdarma a výchozí na claude.ai, 1M kontext#53 Arena tvůrčí psaní; 75,0 LiveBench Language$2 / $10, nyní trvale
Claude Opus 5Profesionální výstupy s ohledem na cenu#2 GDPval-AA v2 se skóre 1824, před Fable 5 (1723)Za Fable 5 na Arena text, za Fable 5.1 na GDPval-AA v2$5 / $25
GPT-5.5Faktograficky ukotvené obchodní psaníDoložené zlepšení faktografické spolehlivosti oproti GPT-5.4Úrovně uvažování nyní označeny jako zastaralé$5 / $30
Gemini 3.7 FlashHromadné koncepty ve velkémNejrychlejší výstup ze všech měřených modelů (385,1 tok/s), Intelligence Index 56Laděný spíše na kód než na prózu; úvodní cena se 1. ledna 2027 zdvojnásobí$0.75 / $3.75
Druhé místo a alternativy: Kimi K3 je druhý pro tvůrčí beletrii a vyhrává EQ-Bench naprosto, Claude Sonnet 5 je druhý v poměru cena/výkon a ten, který použít, pokud neplatíte, Claude Fable 5.1 je volba, pokud chcete nejvyšší naměřené schopnosti za stejnou cenu jako Fable 5, Claude Opus 5 je levnější volba pro profesionální výstupy a Gemini 3.7 Flash je volba pro hromadné psaní konceptů, nyní nejrychlejší měřený model a za stejnou cenu jako 3.6 Flash.
Co se tento měsíc změnilo

Koruna za psaní zůstává u Claude Fable 5, ale 1. září se argument pro ni zúžil. Anthropic vydal Claude Fable 5.1 a ten si bere Humanity's Last Exam se skóre 59,1 % proti 55,5 % u Fable 5, žebříček GDPval-AA v2 se skóre 1853 a Intelligence Index se skóre 66. Co nemá, je jediný hlas v Areně, a tato koruna spočívá na textovém žebříčku a žebříčku tvůrčího psaní Areny, kde je Fable 5 stále #1 se skóre 1508.6 k datu 1. srpna. Fable 5.1 tedy jde do tabulky jako schopnější volba za stejných $10 / $50 a korunu znovu otestujeme ve chvíli, kdy jej Arena ohodnotí. Dvě čísla, která jsme uváděli minulý měsíc, byla také přepočítána: AA-Omniscience nyní čte 43 pro oba modely Fable místo 40 a Artificial Analysis měří Fable 5 na Humanity's Last Exam na 55,5 % místo 53,3 %.

Volba kategorie, září 2026

Nejlepší AI pro chat & každodenního asistenta

1
GPT-5.6
Výchozí model ChatGPT
2
Claude Fable 5
Nejlépe hodnocený
3
Claude Opus 5
Promyšlená hloubka

Nejlepší AI pro každodenní chat je GPT-5.6 a upřímným důvodem je dosah, ne pozice na žebříčku. Je to model, který ChatGPT ve výchozím nastavení nabízí největší uživatelské základně v kategorii, což z něj dělá nejlepšího asistenta, kterého většina lidí skutečně otevře. V čisté lidské preferenci lídrem není: GPT-5.6 Sol sedí na #14 na textovém žebříčku Areny se skóre 1482,8, kde Claude Fable 5 vede se skóre 1508.6. Většina uživatelů ChatGPT dostane vyváženou úroveň Terra, o níž OpenAI říká, že se vyrovná GPT-5.5, a od snížení cen 30. července 2026 stojí o 60 % méně. Je dostupný v ChatGPT (zdarma s limity, Plus za $20/měsíc, Pro za $100/měsíc), přes API (Luna $0.20 / $1.20, Terra $2 / $12, Sol $4 / $20 za 1M tokenů) a zabalený uvnitř Fello AI vedle Claude, Gemini, Grok a DeepSeek. Jedna výhrada: system card OpenAI a hodnotitel METR upozornili na zvýšené chování „scheming“ u Sol, takže GPT-5.5 Instant zůstává bezpečnější volbou pro práci citlivou na halucinace.

ModelNejlepší proSilná stránkaSlabinaCena
GPT-5.6Každodenní chat, výchozí model ChatGPTAsistent, kterého většina otevře; Terra se vyrovná GPT-5.5 za ~poloviční cenu#14 na Arena text; scheming označen METRZdarma / $20/měs. Plus; API $0.20 / $1.20 až $4 / $20
Claude Fable 5Nejlépe hodnocená konverzace#1 na Arena text celkově (1508.6) a v 6 ze 7 podkategoriíŽádná bezplatná verze; přístup přes kredity použití na Pro$10 / $50 API
Claude Opus 5Promyšlené, jemné odpovědi#1 Artificial Analysis Intelligence Index (63) a Agentic Index (55.3)#6 na Arena text, za Claude Fable 5$20/měs. Pro, $5 / $25 API
GPT-5.5 InstantKaždodenní práce citlivá na halucinaceO 52,5 % méně halucinovaných tvrzení vs. 5.3 InstantÚrovně uvažování nyní označeny jako zastaralé$20/měs. Plus; API $5 / $30
Gemini 3.6 FlashRychlý, zdarma, multimodálníStále model, který dostává bezplatná úroveň Gemini, 1M kontext, #12 na Arena textSlabší v nejtěžším uvažování; 3.7 Flash jej předčí za stejnou cenuZdarma / $0.75 / $3.75 API
Fello AIVšechny top modely, jedna aplikaceChatGPT + Claude + Gemini + Grok + DeepSeek a další na Macu, iPhonu a iPaduSměrováno přes aplikaci, ne přímo$9.99/měs.
Druhé místo a alternativy: Claude Fable 5 je druhý a skutečný lídr preferencí, Claude Opus 5 je druhý pro promyšlené každodenní použití, Gemini 3.6 Flash je druhý pro rychlý a zdarma a Grok 4.6 je nika pro dny s živými zprávami. Fello AI je přirozená volba, pokud chcete top modely v jedné aplikaci pro Mac a iOS za $9.99/měsíc místo žonglování s předplatnými.
Co se tento měsíc změnilo

GPT-5.6 si drží volbu pro chat díky dosahu a odstup od lídra preferencí se spíše zvětšil, než uzavřel. K datu 1. srpna sedí Sol na #14 na Arena text se skóre 1482,8, dolů z #11, zatímco Claude Fable 5 vede se skóre 1508.6. Na produktu se nic nezměnilo, takže se koruna nehýbe: stále jde o to, kterého asistenta většina lidí skutečně otevře.

Volba kategorie, září 2026

Nejlepší AI na obrázky

1
ChatGPT Images 2.0
Text v obrázcích
2
Reve 2.1
Rozvržení & 4K
3
Muse Image
Úpravy obrázků

Nejlepší AI na generování obrázků je ChatGPT Images 2.0 a je to nejméně sporná koruna na této stránce. GPT Image 2 vede žebříček generování obrázků z textu Areny se skóre 1385 Elo a její žebříček úprav obrázků se skóre 1463 a Artificial Analysis jej řadí na první místo na své vlastní obrázkové aréně se skóre 1339,4. Je to přirozená volba, kdykoli má váš obrázek obsahovat čitelná slova, v češtině nebo v jiném písmu, a je zahrnutý v ChatGPT Plus a Pro. Druhá místa se změnila. Reve 2.1 (9. července) je skutečná #2 v generování obrázků z textu se skóre 1302 a Reve 2.0 nyní sedí za ní na obou žebříčcích. Muse Image od Mety je #3 na žebříčku generování obrázků z textu Areny a #2 v úpravách obrázků, nejsilnější výsledek, jaký kdy nějaký obrázkový model Mety zvládl. Nano Banana Pro od Googlu už není druhý celkově: v generování obrázků z textu se řadí mezi #8 a #11, pod svého vlastního levnějšího sourozence Nano Banana 2, ačkoli v úpravách obrázků se umísťuje výše.

ModelNejlepší proSilná stránkaSlabinaCena
ChatGPT Images 2.0Obrázky s čitelným textem#1 generování obrázků z textu (1385) a #1 úpravy obrázků (1463)Méně fotorealistický než obrázková řada GeminiZahrnuto v ChatGPT Plus
Reve 2.1Rozvržení, typografie, nativní 4K#2 generování obrázků z textu se skóre 1302, úpravy zachovávající rozvrženíMenší ekosystémZdarma / od $7.99/měs.
Muse ImageÚpravy obrázků, ekosystém Meta#3 generování obrázků z textu, #2 úpravy obrázků (1407)Nové, tenké nástroje kolemAplikace Meta AI
Nano Banana 2 (Gemini 3.1 Flash Image)Fotorealistické portréty a produktyPředčí Nano Banana Pro na obou žebříčcíchSlabší v textu v obrázkuAplikace Gemini / AI Studio
Seedream 5.0 ProVícejazyčný text + úpravy oblastí10+ jazyků včetně arabštiny RTL, laso a vrstvové úpravyŽádné nezávislé benchmarky; nejistota kolem autorských právBytePlus / Magnific
Midjourney v8Stylizované umění, ilustraceEstetický základ, který většina umělců preferujeSlabší v textu v obrázku$10-$120/měs.
Grok ImagineNSFW / Spicy ModeNejvolnější mantinelyMenší model za tím$30/měs. SuperGrok
Druhé místo a alternativy: Reve 2.1 je druhý celkově a volba pro rozvržení a typografii, Muse Image je druhý pro úpravu obrázku, který již máte, a Nano Banana 2 je fotorealistická volba. Grok Imagine je stále jediný frontier model, který umožňuje obsah pro dospělé v režimu Spicy Mode.
Co se tento měsíc změnilo

Obrázková koruna je beze změny a GPT Image 2 stále vede všechny tři žebříčky, které sledujeme, na Arena generování obrázků z textu (1385), Arena úpravy obrázků (1463) a obrázkové aréně Artificial Analysis (1339,4). Jediným přírůstkem je MAI-Image-2.5 od Microsoftu, který sedí třetí na obrázkovém žebříčku Artificial Analysis se skóre 1269,7 a třetí na žebříčku úprav obrázků Areny, takže třetí místo nyní závisí na tom, kterou firmu čtete.

Volba kategorie, září 2026

Nejlepší AI na video

1
Gemini Omni Flash
#1 na obou video žebříčcích
2
MiniMax H3
2K + nativní zvuk
3
Dreamina Seedance 2.0
Nejbližší vyzyvatel

Nejlepší AI na generování videa je Gemini Omni Flash, který vede žebříček generování videa z textu Areny se skóre 1527 Elo, celých 45 bodů před druhým místem, a také kraluje video aréně Artificial Analysis. Je #1 u obou firem, což žádný jiný video model nezvládne. Ceny běží $1.50 na vstupu a $17.50 za 1M video výstupních tokenů, což vychází zhruba na $0.10 za sekundu hotového videa, a podporuje konverzační úpravy. Jediný skutečný limit je délka: Omni Flash generuje 10sekundové klipy. Pokud potřebujete delší záběry, Veo 3.1 zůstává správným nástrojem v aplikaci Gemini, AI Studio a Vertex AI, s nativním zvukem a výstupem 1080p. Tímto se nahrazuje Veo 3.1 na vrcholu kategorie; Veo 3.1 je dobrý model, ale ne vedoucí, s jeho nejlepší variantou na #6 na žebříčku generování videa z textu Areny. Kandidát, kterého sledovat, je MiniMax H3 (31. července), který generuje 2K klipy o délce 4 až 15 sekund s nativním stereo zvukem a účtuje se za sekundu od $0.13 při 2K, už #2 na video žebříčku Artificial Analysis se skóre 1241,5. Korunu kvůli tomu nehýbeme: odstup je 3,3 Elo na jediném žebříčku, který se mezi analýzami nereprodukoval, a H3 stále nemá žádné hlasy na žebříčku generování videa z textu Areny.

ModelNejlepší proSilná stránkaSlabinaCena
Gemini Omni FlashNejlepší AI video celkově#1 na obou video žebříčcích (1527 Arena), konverzační úpravyOmezeno na 10sekundové generování~$0.10/sek.; aplikace Gemini / AI Studio
MiniMax H32K klipy s nativním zvukem4-15 s při 2K, nativní stereo zvuk; #2 na AA video (1241.5)Zatím žádné hlasy Areny; otevřené váhy neobsahují upscaler 2K a v USA, EU, Spojeném království a Jižní Koreji vyžadují žádost$0.13/sek. při 2K
Dreamina Seedance 2.0Nejbližší vyzyvatel#2 generování videa z textu (1482) a #1 v generování videa z obrázku se zvukem (1198)Ekosystém ByteDance, omezený západní přístupDreamina / BytePlus
Muse VideoVideo v ekosystému Meta#3 generování videa z textu se skóre 1459Nejnovější ze skupiny, tenké nástrojeAplikace Meta AI
Veo 3.1Delší produkční klipyNativní zvuk, 1080p, silná fyzikální konzistence#6 na Arena video, ne lídr kvalityGoogle AI Pro / Ultra
Kling 3.0 / 3.0 TurboRychlá iterace za nižší cenuNativní 4K, 60fps, 15sekundové klipy; Turbo vyšel 17. červnaMimo top 16 na Arena generování videa z textuOd $10/měs.
Luma Ray 3Fotorealistické scénySilný realismus pro krajinyMenší komunitaZdarma / od $9.99/měs.
Druhé místo a alternativy: Dreamina Seedance 2.0 je druhá celkově a Omni Flash poráží v generování videa z obrázku se zvukem, kde vede 1198 proti 1191, ačkoli Omni Flash stále vede variantu bez zvuku. Muse Video je třetí a Veo 3.1 je volba, když 10 sekund nestačí. OpenAI 26. dubna 2026 zrušil spotřebitelskou aplikaci Sora 2 a zůstává jen vývojářské API, do 24. září 2026.
Co se tento měsíc změnilo

Gemini Omni Flash si drží video korunu a je stále #1 na obou žebříčcích, se skóre 1527,5 na Areně a 1244,8 na Artificial Analysis. MiniMax H3 (31. července) vstupuje jako kandidát na #2 na video žebříčku Artificial Analysis (1241,5), o 3,3 Elo zpět, a poráží Omni Flash ve specifikaci s výstupem 2K, klipy až 15 sekund a nativním stereo zvukem. Korunu držíme, protože ten odstup je 3,3 Elo na jediném žebříčku a H3 stále nemá žádné hlasy na žebříčku generování videa z textu Areny. MiniMax váhy 3. srpna otevřel, ale jen H3-Base spolu s VAE a enkodérem; upscaler 2K, na kterém stojí jeho výhoda ve specifikaci, zůstal jen v API.

Volba kategorie, září 2026

Nejlepší AI na programování

1
Claude Opus 5
#1 Arena WebDev
2
Claude Fable 5
Nejtěžší dlouhodobé úlohy
3
Kimi K3
Webové aplikace a agenti

Nejlepší AI na programování je Claude Opus 5 a vyhrává na obou žebříčcích, kde vývojáři hlasují o hotovém výsledku, spíše než skript měří harness. Je #1 na žebříčku WebDev Areny se skóre 1,702.9 a #1 v image-to-WebDev se skóre 1,668.6, k hlasovacím hranicím 1. srpna a 31. července. Cena je druhou polovinou argumentu: Opus 5 běží $5 / $25 za 1M tokenů proti $10 / $50 u Claude Fable 5 a Artificial Analysis jej měří na $2.34 na indexovou úlohu proti $3.14 u Fable 5. Vlastní dokumentace Anthropicu vývojářům radí začít s Opus 5 pro komplexní agentické programování a rezervovat Fable 5 pro zátěže, které vyžadují nejvyšší dostupné schopnosti. Claude Fable 5 je druhý a zůstává volbou pro nejtěžší dlouhodobé úlohy, na #4 ve WebDev (1,630.7) a #2 v image-to-WebDev (1,625.7); jeho nástupce z 1. září, Claude Fable 5.1, je na benchmarcích s harness silnější za stejnou cenu, dosahuje 55,8 % na Terminal-Bench 4.0 proti 52,3 % u Opus 5 a 42,0 % u Fable 5 podle vlastních čísel Anthropicu, ale Arena pro něj zatím nemá hlasy. Kandidátem je Kimi K3, který bere #2 ve WebDev se skóre 1,675.5 a #3 na žebříčku Agent Areny, nejsilnější open-weight kodér na žebříčcích, ačkoli self-hosting znamená 1,56 TB vah. Na Coding Index od Artificial Analysis to není zametení Claudem: GPT-5.6 Sol (xhigh) vede se skóre 78,3 s Opus 5 (max) na 78,0, dost blízko na remízu. Nejlevnějším seriózním kandidátem je nyní GLM 5.3 Flash za $0.15 / $0.50 pod MIT, poté co zdražení DeepSeeku ze 16. srpna zvedlo V4-Flash 0731 na $0.22 / $0.66 mimo špičku a $0.44 / $1.32 ve špičce, a nejlepším poměrem přímo na frontier je Grok 4.6, který dosahuje 88,4 % na Terminal-Bench v2.1 a $0.84 na indexovou úlohu za $2 / $6.

ModelNejlepší proSilná stránkaSlabinaCena (za 1M tokenů)
Claude Opus 5Nejlepší programování celkově#1 Arena WebDev (1,702.9) a #1 image-to-WebDev (1,668.6); $2.34 na indexovou úlohuArtificial Analysis Coding Index má GPT-5.6 Sol o kousek napřed$5 / $25
Claude Fable 5Nejtěžší agentické dlouhodobé úlohy#2 Arena image-to-WebDev (1,625.7), #4 WebDev; 1M kontextNejdražší; Artificial Analysis Coding Index jej řadí sedmý$10 / $50
Claude Fable 5.1Agentické programování s nejvyššími schopnostmi#1 Intelligence Index (66) a #1 Agentic Index (61); 55,8 % na Terminal-Bench 4.0 (Anthropic)Zatím žádné hlasy v Areně; dvojnásobná cena oproti Opus 5$10 / $50
Kimi K3Stavba webových aplikací a agenti#2 Arena WebDev (1,675.5), #3 Arena Agent, nejvyšší otevřený Intelligence Index (60)1,56 TB pro self-hosting$3 / $15
GPT-5.6 SolVlajkový model OpenAI, agentické programování#1 Artificial Analysis Coding Index se skóre 78,3 (xhigh)Chybí na oficiálním žebříčku Terminal-Bench; eval-gaming označen METR$4 / $20
Muse Spark 1.2Levné agentické programováníIntelligence Index 57 za $1.25 / $4.25; 80 % na Terminal-Bench 2.1 (Artificial Analysis)Druhý za Opus 5 na všech třech vlastních programátorských grafech Mety (82,9 % vs. 86,7 %); Scale SEAL ohodnotil jen 1.1$1.25 / $4.25
Grok 4.6Levný kodér s dobrým poměrem cena/výkon88,4 % na Terminal-Bench v2.1 a Intelligence Index 61, za $0.84 na indexovou úlohuPrompty od 200K tokenů výše se přeúčtují celé dvojnásobnou sazbou; vyšší míra halucinací$2 / $6
Gemini 3.7 FlashAgentické programování ve velkémIntelligence Index 56, 65,3 % DeepSWE v1.1, 85,8 % Terminal-Bench 2.1, 385,1 tok/s14,9 % na těžším Terminal-Bench 3.0; úvodní cena se 1. ledna 2027 zdvojnásobí$0.75 / $3.75
GLM 5.3 FlashNejlepší open-weight kodér, který si můžete hostitIntelligence Index 57; DeepSWE v1.1 63,4 a Terminal Bench 2.1 84,3 (údaje dodavatele); MIT, 320B/18B aktivníchKimi K3 jej předčí; čísla pro programování jsou od dodavatele a zatím nemá hlasy v AreněOpen weights (MIT)
Druhé místo a alternativy: Kimi K3 je druhý na žebříčku WebDev Areny a volba, pokud chcete nejsilnější open weights, Claude Fable 5 je druhý pro nejtěžší dlouhodobé úlohy, přičemž Claude Fable 5.1 je schopnější verzí téže volby za stejnou cenu, GPT-5.6 Sol je druhý na kompozitu Artificial Analysis a GLM 5.3 Flash je open-weight volba pro týmy, které si jej hostí samy, na Intelligence Index 57 pod čistou MIT, a tuto pozici si drží i teď, když váhy samotného GLM 5.3 dorazily pod vlastní licencí Z.ai a ve více než dvojnásobné velikosti. Uvnitř IDE je Cursor s Claudem stále nejoblíbenější kombinací a Claude Code je přirozená volba, pokud žijete v terminálu.
Co se tento měsíc změnilo

Programátorská koruna se přesunula na Claude Opus 5. Arena jej dohodnotila a skončil první na obou programátorských žebříčcích, WebDev se skóre 1,702.9 a image-to-WebDev se skóre 1,668.6, s Claude Fable 5 čtvrtým a druhým. To jsou hlasovací žebříčky se zveřejněnými hranicemi, takže koruna nyní spočívá na lidských srovnáních, nikoli na jediném harness, a Opus 5 to zvládá za poloviční cenu oproti Fable 5. Fable 5 se stává druhým pro nejtěžší dlouhodobé úlohy a Kimi K3 zůstává kandidátem na #2 ve WebDev. Muse Spark 1.2 od Mety dorazil 5. srpna a to nemění, protože na vlastních grafech Mety končí druhý za Opus 5 na každém zveřejněném programátorském benchmarku. Ani Grok 4.6 (12. srpna) korunu nebere, ale je to model, který je třeba sledovat kvůli ceně: dosahuje 88,4 % na Terminal-Bench v2.1 a dlouhé agentické úlohy dokončí zhruba na polovinu tahů oproti Opus 5, za $2 / $6 proti $5 / $25. Hned po něm přistála další dvě uvedení zaměřená na programování. Gemini 3.7 Flash (13. srpna) nahrazuje v této tabulce 3.6 Flash díky skoku ze 49,0 % na 65,3 % na DeepSWE v1.1 za poloviční cenu a GLM 5.3 (14. srpna) má největší agentický nárůst měsíce, Terminal-Bench 3.0 ze 4,6 na 28,3, ale vyšel bez stažitelných vah. Z.ai zakončilo měsíc tím, že místo toho otevřelo jiný model: GLM 5.3 Flash (26. srpna) dorazil pod MIT hned první den s Intelligence Index 57 a přebírá open-weight pozici v programování od GLM-5.2. Poslední dny měsíce pak přinesly tři další otevřená vydání: vlastní váhy GLM 5.3 dne 28. srpna pod vlastní licencí místo MIT, Qwen3.8-Flash-Next od Alibaby 26. srpna jako ukázku architektury Qwen4 a Hy4 Preview od Tencentu se 770B dne 28. srpna pod Apache 2.0. Ani jeden z nich zatím nemá nezávislé hodnocení v programování, takže touto tabulkou žádný nehýbe. Anthropic pak zahájil září 1. dnem, kdy vydal Claude Fable 5.1, který vede Intelligence Index i Agentic Index od Artificial Analysis a dosahuje 55,8 % na Terminal-Bench 4.0 proti 52,3 % u Opus 5, ale Arena jej neohodnotila, takže koruna zůstává tam, kde jsou hlasy.

Volba kategorie, září 2026

Nejlepší AI na kreativitu

1
Grok 4.6
Nejméně mantinelů
2
Claude Fable 5
Próza nejvyšší kvality
3
Kimi K3
Beletrie a hlas

Nejlepší AI na nefiltrovanou, trendovou tvůrčí práci je Grok 4.6 a chceme být přesní, proč. Tato volba je o produktu, ne o kvalitě prózy. Grok nese nejméně obsahových omezení ze všech frontier modelů a jako jediný nativní integraci X v reálném čase, což z něj dělá jediný model, který se pustí do odvážných, aktuálních nebo záměrně provokativních zadání, jež ostatní odmítají. Je výchozím modelem v aplikaci Grok pro předplatitele SuperGrok a X Premium+ za $30/měsíc. Není to nejlepší pisatel a žebříčky to říkají bez obalu. Grok 4.5 sedí na #33 na EQ-Bench Creative Writing a #41 na žebříčku tvůrčího psaní Areny a prohrává na obou se starším Grok 4.20-beta1. Pokud vybíráte podle samotné kvality výstupu, Claude Fable 5 vyhrává naprosto na #1 na Arena tvůrčí psaní a Kimi K3 vyhrává EQ-Bench. Grok 4.5 volte pro to, co vám dovolí vytvořit, ne pro to, jak dobře píše.

ModelNejlepší proSilná stránkaSlabinaCena
Grok 4.6Nefiltrovaný, vyhraněný, trendovýNejméně obsahových omezení, nativní ukotvení v X v reálném časeŽebříčky tvůrčího psaní jej zatím nehodnotily; Grok 4.5 byl #33 EQ-Bench, #41 Arena$30/měs. SuperGrok
Claude Fable 5Tvůrčí próza nejvyšší kvality#1 Arena tvůrčí psaní, #1 LiveBench LanguageOpatrné mantinely u odvážných zadání$10 / $50 API
Kimi K3Beletrie a osobitý hlas#1 EQ-Bench Creative Writing se skóre 2377Jen #10 na Arena tvůrčí psaní$3 / $15
Claude Opus 5Strukturovaná dlouhá tvůrčí práceDrží dlouhá vlákna a sám se edituje; Intelligence Index 63, druhý hned za Claude Fable 5.1Nejopatrnější ze skupiny$20/měs. Pro; $5 / $25 API
Gemini 3.1 ProMultimodální tvůrčí práceSilný řetězec textu, obrázku a videaKvóty v aplikaci GeminiZdarma / $2.00-$4.00 API vstup
Grok Imagine (Spicy Mode)NSFW / tvůrčí práce pro dospěléNejvolnější generování obrázkůNika$30/měs. SuperGrok
Druhé místo a alternativy: Claude Fable 5 je druhý a správná volba, pokud kvalita znamená víc než volnost, Kimi K3 je volba pro beletrii a Claude Opus 5 je volba pro tvůrčí projekty, které se táhnou přes mnoho kol. Pro tvůrčí práci pro dospělé je Grok Imagine Spicy Mode stále jedinou možností na úrovni frontier.
Co se tento měsíc změnilo

Grok si drží tuto volbu, nyní s Grok 4.6, který 12. srpna nahradil Grok 4.5 jako vlajkový model SpaceXAI. Na volnosti ani na živém přístupu k X, na čemž tato volba stojí, se nic nezměnilo. Model pod tím je citelně silnější, o pět bodů výš na Intelligence Index 61, jenže tento zisk přistál v programování a agentické práci, ne v próze, a žádný žebříček tvůrčího psaní zatím Grok 4.6 nehodnotil. Claude Fable 5 zůstává modelem, který použít, když chcete lepší psaní.

Volba kategorie, září 2026

Nejlepší AI na přesnost & výzkum

1
Gemini 3.1 Pro
98 % ARC-AGI-1
2
Claude Fable 5
Ukotvené vyhledávání
3
GPT-5.6 Sol
Nové uvažování

Nejlepší AI na přesnost a výzkum je Gemini 3.1 Pro. Jeho nejsilnější výsledek je na ARC-AGI-1 od ARC Prize, kde dosahuje 98 % a vyrovnává lidský panel, a to za $0.52 na úlohu. Tato kombinace je argument: několik modelů je schopnostmi blízko, žádný jej nedosahuje v ceně za spolehlivou faktografickou práci. Kombinuje to s nativním ukotvením ve vyhledávání Google, což chcete, když odpověď musí být aktuální, ne jen věrohodná. Dosahuje také 94,1 % na GPQA Diamond, kde se s ním GPT-5.6 Sol nyní vyrovnává, místo aby zaostával, a 44,4 % na Humanity's Last Exam a vede žebříček HLE od Scale SEAL se skóre 46,44. Zrušili jsme předchozí rámování přes ARC-AGI-2: jeho 77,1 % je stále správných, ale žebříček se pohnul a toto skóre jej nyní řadí kolem 14. místa. Dvě upřímné výhrady. Konkrétně u ukotveného vyhledávání vede žebříček vyhledávání Areny Anthropic, ne Google, s Gemini 3.1 Pro s ukotvením na #7. A v novém uvažování vede GPT-5.6 Sol ARC-AGI-2 a Claude Opus 5 vede ARC-AGI-3 se skóre 30 %, zhruba 3,75násobek dalšího nejlepšího modelu. Korunu jsme na Opus 5 nepřesunuli, protože Artificial Analysis měří jeho míru halucinací na 50 % a řadí jej pod Fable 5 na AA-Omniscience, na jehož vrcholu nyní Claude Fable 5.1 stojí spolu s ním.

ModelNejlepší proKlíčový benchmarkSlabinaCena
Gemini 3.1 ProLevná, spolehlivá faktografická práce98 % ARC-AGI-1 (vyrovnává lidský panel) za $0.52/úlohu, 94,1 % GPQA (vyrovnáno Sol)ARC-AGI-2 77,1 % nyní ~14.; #7 na Arena vyhledávání$2.00-$4.00 / $12.00-$18.00 (odstupňováno)
Claude Fable 5Ukotvené vyhledávání#1 a #3 na žebříčku vyhledávání Areny, před GooglemŽádná jediná levná úroveň$10 / $50 (Fable 5)
GPT-5.6 SolNové uvažování#1 ARC-AGI-2 se skóre 92,5 %, proti 100% lidskému paneluScheming označen METR$4 / $20
Claude Opus 5Nejtěžší neviděné problémy#1 ARC-AGI-3 se skóre 30 %, ~3,75násobek dalšího modelu (ARC Prize)Artificial Analysis měří míru halucinací 50 %$5 / $25
Qwen 3.7 MaxFrontier přesnost za výhodnou cenu92,4 GPQA Diamond, 200 dotazů zdarma/denJen API, žádné chatovací rozhraní$1.25 / $3.75 promo; $2.50 / $7.50 ceníková
Claude Opus 4.6Poctivost pod tlakem#1 na žebříčku MASK od Scale SEAL se skóre 96,28; Anthropic drží top 5Nahrazen jako vlajkový modelStarší model Anthropicu
Druhé místo a alternativy: modely Anthropicu jsou druhé pro ukotvené vyhledávání a zametají žebříček poctivosti pod tlakem, GPT-5.6 Sol je druhý pro nové uvažování a Qwen 3.7 Max je výhodná volba na frontier.
Co se tento měsíc změnilo

Gemini 3.1 Pro si drží korunu za přesnost, ale jeho hlavní číslo už není náskokem. Jeho skóre GPQA Diamond se přepočítalo na 94,1 % a GPT-5.6 Sol se s ním nyní přesně vyrovnává, takže koruna spočívá na výsledku ARC-AGI-1 za $0.52 na úlohu plus ukotvení ve vyhledávání, nikoli na GPQA. Toto je další koruna, kterou znovu testujeme, a žebříčky měřící, jak často se model prostě mýlí, se 1. září pohnuly. Claude Fable 5.1 nyní drží nejvyšší faktografickou přesnost, jakou kdy Artificial Analysis naměřil, 67 % proti 65 % u Claude Fable 5, a vede Humanity's Last Exam se skóre 59,1 % proti 55,5 %. Samotný index AA-Omniscience čte 43 pro oba modely, výš než 40, které jsme u Fable 5 uváděli minulý měsíc, protože 5.1 si svou vyšší přesnost kupuje častějšími pokusy o odpověď na otázky, které neumí.

Volba kategorie, září 2026

Nejlepší AI na řešení problémů

1
GPT-5.6 Sol
Vlajkový model pro STEM
2
Claude Opus 5
Agentické řetězce
3
GPT-5.5 Pro
Ověřený FrontierMath

Nejlepší AI na těžké řešení problémů je GPT-5.6 Sol a je to nejlépe podložená koruna na této stránce. Bere #1 na LiveBench Mathematics se skóre 96,2, #1 na LiveBench Reasoning se skóre 91,7 a #1 na ARC-AGI-2 se skóre 92,5 %, nejblíže, jak kdy nějaký model dospěl ke 100% lidskému panelu. Tři samostatné firmy jej řadí první v úlohách uvažování, na kterých záleží, což je víc shody, než produkuje jakákoli jiná kategorie na této stránce. OpenAI stále nezveřejnil skóre Sol na FrontierMath, takže ověřenou známkou OpenAI zůstává 39,6 % u GPT-5.5 Pro na FrontierMath Tier 4 a Solovo číslo doplníme ve chvíli, kdy vyjde na veřejnost. Qwen 3.7 Max je výhodná alternativa pro problémy soutěžního typu se skóre 97,1 na indexu HMMT z února 2026 a 44,5 na Apex, za zlomek ceny ChatGPT Pro, a nyní zahrnuje 200 dotazů na model zdarma denně. Claude Opus 5 je alternativa pro dlouhé agentické řetězce uvažování, se skóre 59 na Agentic Index od Artificial Analysis, druhý za 61 u Claude Fable 5.1, a #1 na ARC-AGI-3 od ARC Prize se skóre 30 %, zhruba 3,75násobek dalšího nejlepšího modelu.

ModelNejlepší proKlíčový benchmarkSlabinaCena
GPT-5.6 SolNejtěžší matematika, věda a uvažování#1 LiveBench Mathematics (96.2), #1 LiveBench Reasoning (91.7), #1 ARC-AGI-2 (92,5 %)FrontierMath stále nezveřejněn; scheming označen METR$100/měs. ChatGPT Pro; API $4 / $20
Claude Opus 5Dlouhé agentické řetězce uvažování#2 Agentic Index (59), #1 ARC-AGI-3 (30 %)Druhý na LiveBench Reasoning; míra halucinací 50 %$5 / $25
GPT-5.5 ProOvěřený lídr FrontierMath39,6 % FrontierMath Tier 4Nahrazen Sol jako vlajkový model$100/měs. ChatGPT Pro
Qwen 3.7 MaxSoutěžní matematika na rozpočet97,1 HMMT 2026 únor, 44,5 Apex, 200 dotazů zdarma/denJen API$1.25 / $3.75 promo; $2.50 / $7.50 ceníková
Claude Fable 5Matematika uvnitř programátorského workflow#1 na matematické podkategorii Areny (1543), 96,0 LiveBench MathematicsNejdražší volba zde$10 / $50
GLM 5.3 FlashOpen-weight řešení problémůIntelligence Index 57 pod MIT, o čtyři body více než GLM-5.2 při méně než poloviční velikosti; 320B/18B aktivních, 1M kontextPotřebuje multi-GPU server, ne pracovní stanici; GLM 5.3 skóruje výš podle vlastních čísel Z.ai a od 28. srpna jej lze stáhnout, ale ve více než dvojnásobné velikosti a pod vlastní licencíOpen weights (MIT)
Druhé místo a alternativy: Claude Opus 5 je druhý a přirozená volba pro dlouhé řetězce agentického uvažování, Claude Fable 5 je druhý na matematickém žebříčku Areny, Qwen 3.7 Max je výhodná volba a GLM 5.3 Flash je open-weight volba.
Co se tento měsíc změnilo

GPT-5.6 Sol si drží tuto korunu a získal druhý argument. Sol nyní také vede Terminal-Bench v2.1 od Artificial Analysis se skóre 89,5 % a jeho Coding Index se skóre 78,3 a vyrovnává se Gemini 3.1 Pro na GPQA Diamond se skóre 94,1 %. Claude Opus 5 zůstává alternativou pro agentické uvažování na síle ARC-AGI-3. Dne 1. srpna OpenAI pojmenoval svou další rodinu modelů Astra a zveřejnil deset nových matematických výsledků z interní verze, ačkoli Astra je nevydaná a nemá datum, cenu ani dostupnost. Claude Fable 5.1 od Anthropicu dorazil 1. září a vzal Agentic Index Opus 5, 61 proti 59, což mění podpůrné číslo alternativy, nikoli korunu.

Volba kategorie, září 2026

Nejlepší AI agent

1
Gemini Spark
24/7 cloud
2
Claude Cowork
Desktopová AI
3
ChatGPT Codex
Programátorský agent

Nejlepším AI agentem právě teď je Gemini Spark pro práci běžící v cloudu 24/7 a Claude Cowork pro práci běžící na desktopu, s ChatGPT Codex jako alternativou pro programátorské agenty a s prohlížečovými agenty třídy OpenAI Operator jako alternativou pro webové úlohy. AI agenti jsou nejrychleji se pohybující kategorií roku 2026: každý top dodavatel nyní dodává agentní produkt a praktická volba je mezi agenty, kteří žijí v cloudu (běží, když je váš laptop zavřený), a agenty, kteří žijí na vašem desktopu (řídí vaše aplikace přímo). Gemini Spark byl uveden na Google I/O dne 19. května 2026 a je prvním cloudovým agentem 24/7. Claude Cowork dosáhl obecné dostupnosti 9. dubna 2026 a běží jako desktopový agent, který řídí vaše lokální aplikace. ChatGPT Codex Mobile (14. května) je volba pro práci s programátorskými agenty. Přečtěte si úplné srovnání Gemini Spark vs. Claude Cowork.

AgentNejlepší proKde běžíSilná stránkaCena
Gemini Spark24/7 cloudové úlohy, workflow WorkspaceGoogle Cloud VM (vždy zapnuto)První skutečný agent 24/7, hluboká integrace Workspace$99.99/měs. Google AI Ultra
Claude CoworkDesktop, řízení aplikací, design + kódVáš desktop Mac/WindowsŘídí lokální aplikace, vidí vaši obrazovku$20/měs. Claude Pro
ChatGPT Codex MobileProgramátorský agent v telefonuCloud OpenAI + iOS/AndroidSchvalování diffů a přesměrování práce z telefonuZahrnuto v plánech ChatGPT
Grok Agentic (Grok 4.6)Výzkum v reálném čase, scraping XCloud SpaceXAINativní integrace X; Elo 1755 na GDPval-AA v2$30/měs. SuperGrok
OpenAI třídy OperatorÚlohy v prohlížeči, webové formulářeCloud OpenAI + váš prohlížečWebová automatizaceChatGPT Pro
Druhé místo a alternativy: Claude Cowork je druhý celkově a přirozená volba, když chcete agenta na svém stroji, který řídí vaše aplikace. ChatGPT Codex Mobile je druhý pro programátorské agenty. Grok Agentic je nika pro výzkum v reálném čase.
Co se tento měsíc změnilo

Žádní noví spotřebitelští agenti nevyšli a Muse Code od Mety (5. srpna) je terminálový vývojářský nástroj, nikoli spotřebitelský, takže volba mezi Gemini Spark (cloud) a Claude Cowork (desktop) stále řídí většinu rozhodnutí o agentech pro jednotlivé uživatele. Modelová vrstva pod nimi se opět pohnula: Claude Fable 5.1 (1. září) nyní vede Agentic Index od Artificial Analysis se skóre 61, před Claude Opus 5 se skóre 59, a kraluje žebříčku GDPval-AA v2 se skóre 1853 proti 1824 u Opus 5. Opus 5 je stále ten, na kterém by většina týmů měla stavět, za $5 / $25, polovinu ceny Fable 5.1, a vede žebříček Agent Areny, s Kimi K3 na třetím místě. Pro týmy stavějící vlastní agenty je Muse Spark 1.2 od Mety (5. srpna) levná agentně nativní možnost za $1.25 / $4.25, jejíž GDPval-AA v2 agentické Elo skočilo z 1371 na 1631, ačkoli Scale SEAL ohodnotil jen starší 1.1, která vede jeho žebříček používání nástrojů MCP Atlas se skóre 88,1. GLM 5.3 Flash (26. srpna, MIT) je nyní open-weight agentní model, který bychom hostovali, na Intelligence Index 57 a s AutomationBench 48,8 na vlastním grafu Z.ai, kde Claude Opus 4.8 má 41,0, i když zatím nemá hlasy v Areně; nezávislý záznam si drží GLM-5.2, na #5 na žebříčku Agent Areny. Grok 4.6 (12. srpna) do této kategorie nepřináší nový agentní produkt, ale nový argument o nákladech: na GDPval-AA v2 má Elo 1755, což jej zářijové přírůstky posunuly na páté místo mezi odlišnými modely, a Artificial Analysis u něj měří dokončení dlouhých úloh zhruba v 53 tazích a 0,5 miliardy vstupních tokenů proti přibližně 103 tahům a 2,0 miliardám u Opus 5, za $0.84 na indexovou úlohu.

Fello AI běžící na Macu, iPhonu a iPadu
Všechny špičkové AI modely, jedna aplikace

Přední modely jako ChatGPT, Claude a Gemini pohromadě na Macu, iPhonu a iPadu.

Začněte zdarma, hodnocení 4,7★ napříč 27 000+ recenzemi.

Stáhnout Fello AI

Průvodce použitím, září 2026

Nejlepší AI pro studenty

1
GPT-5.5 Free
Eseje & výzkum
2
Gemini 3.6 Flash
STEM + PDF
3
Claude Sonnet 5
Psaní & úpravy

Nejlepší AI pro studenty je GPT-5.5 Free uvnitř ChatGPT pro obecnou práci na kurzech a Gemini 3.6 Flash Free uvnitř aplikace Gemini pro STEM a multimodální studium, s Qwen 3.7 Max jako API alternativou pro těžší sady úloh (200 dotazů zdarma denně) a Claude Opus 5 jako alternativou pro úpravy esejí. Většina studentů nemusí platit: bezplatná úroveň ChatGPT nyní ve výchozím nastavení používá GPT-5.6 (s GPT-5.5 stále dostupným), Gemini 3.6 Flash je v bezplatné aplikaci Gemini a v AI Studio, Claude Sonnet 5 je nový bezplatný výchozí Claude a DeepSeek V4 je zdarma na chatovací stránce DeepSeeku. Pro krok za krokem u nejtěžší matematiky je GPT-5.6 Sol novým vlajkovým modelem OpenAI (jeho skóre FrontierMath ještě není zveřejněno, přičemž ověřených 39,6 % u GPT-5.5 Pro na FrontierMath Tier 4 je současnou známkou), ačkoli oba jsou jen placené; Qwen 3.7 Max je výhodná alternativa se skóre 97,1 HMMT 2026 únor s cenami API $1.25 / $3.75 na jeho aktuální 50% promo ($2.50 / $7.50 ceníková).

ÚlohaNejlepší modelPročZdarma?Alternativa
Eseje & práce na kurzechGPT-5.5Zdarma v ChatGPT, zlepšená faktografická spolehlivost vs. 5.4AnoClaude Sonnet 5 (Claude zdarma)
Řešení STEM úlohGPT-5.6 Sol / Qwen 3.7 MaxNový vlajkový model pro STEM (5.5 Pro: 39,6 % FrontierMath) / 97,1 HMMT 2026 únorPro placené / Qwen API placenéGemini 3.6 Flash (zdarma)
Výzkum & přesnostGemini 3.1 Pro98 % ARC-AGI-1 za $0.52/úlohu, nativní ukotvení ve vyhledávání GoogleAno (aplikace Gemini)Claude Opus 5
Úpravy textuClaude Sonnet 5Zdarma a výchozí na claude.ai; Claude Fable 5 je lídr kvalityAno (Claude zdarma)Claude Fable 5
Multimodální studium (PDF, snímky, obrázky)Gemini 3.6 Flash1M kontext, zdarma v aplikaci GeminiAnoNotebookLM (Google)
Druhé místo a alternativy: Claude Sonnet 5 (zdarma) je druhý pro psaní a úpravy esejí. Gemini 3.6 Flash (zdarma) je druhý pro multimodální studium a příjem PDF. DeepSeek V4 je druhý pro řešení problémů na přísně nulovém rozpočtu.
Průvodce použitím, září 2026

Nejlepší AI pro práci & profesionály

1
GPT-5.6
Každodenní znalostní práce
2
Claude Opus 5
Programování & psaní
3
Gemini 3.1 Pro
Výzkum & podklady

Nejlepší AI pro profesionální práci je GPT-5.6 (výchozí model ChatGPT od 9. července) pro každodenní znalostní práci, Claude Opus 5 pro programování a psaní s vysokou mírou odpovědnosti a Gemini Spark pro agentické workflow 24/7. Většina profesionálů vytěží nejvíc, když provozuje dvě placená předplatná (ChatGPT Plus za $20/měsíc plus Claude Pro za $20/měsíc, celkem $40/měsíc), nebo konsoliduje s Fello AI za $9.99/měsíc pro všech pět top modelů v jedné aplikaci pro Mac/iOS. Pro agentickou práci, která běží, když spíte, je Gemini Spark na Google AI Ultra za $99.99/měsíc jediným skutečným cloudovým agentem 24/7.

Případ použitíNejlepší modelKlíčový údajCenaAlternativa
Každodenní znalostní práceGPT-5.6Výchozí model ChatGPT od 9. července; asistent, kterého většina otevře$20/měs. ChatGPT PlusClaude Opus 5
Programování (proprietární)Claude Opus 5#1 na Arena WebDev (1,702.9) a image-to-WebDev (1,668.6); doporučený výchozí model Anthropicu$20/měs. Claude ProClaude Fable 5
Programování (nákladově efektivní)Qwen 3.7 Max80,4 SWE-Verified, 1M kontext$1.25 / $3.75 promo; $2.50 / $7.50 ceníkováDeepSeek V4-Flash 0731
Výzkum & podkladyGemini 3.1 Pro98 % ARC-AGI-1 za $0.52/úlohu, ukotvení GoogleGoogle AI Pro / UltraClaude Opus 5
Těžká matematika, fyzika, finanční modelováníGPT-5.6 SolNový vlajkový model OpenAI pro STEM (5.5 Pro ověřeno na 39,6 % FrontierMath)$100/měs. ChatGPT ProQwen 3.7 Max
Nepřetržité agentické workflowGemini SparkPrvní cloudový agent 24/7$99.99/měs. Google AI UltraClaude Cowork
Živé zprávy, tvůrčí práce s kontextem XGrok 4.6Intelligence Index 61 + nativní ukotvení v X$30/měs. SuperGrokGemini 3.1 Pro
Konsolidace vše v jednomFello AIChatGPT + Claude + Gemini + Grok + DeepSeek$9.99/měs.Platit každému dodavateli zvlášť
Druhé místo a alternativy: pro většinu profesionálních týmů je Claude Opus 5 druhý za GPT-5.6 pro každodenní práci a nyní programátorský lídr naprosto za $5 / $25, s Claude Fable 5 druhým pro nejtěžší dlouhodobé úlohy. Gemini 3.1 Pro je druhý pro role náročné na výzkum a Gemini Spark je jedinečná volba, pokud dokážete nasadit cloudového agenta na dlouhé úlohy.
Srovnání cen

Ceny AI modelů v září 2026

Od bezplatných verzí za $0 po $199.99/měsíc Google AI Ultra. Nejzávažnější cenou v této tabulce je Claude Opus 5 za $5 / $25, protože je to druhý nejvýše hodnocený model na Intelligence Index od Artificial Analysis za poloviční cenu oproti oběma modelům Fable kolem něj. Claude Fable 5.1, který si 1. září vzal vrchol tohoto indexu, drží stejnou ceníkovou cenu $10 / $50 jako Fable 5, ale snižuje čtení z cache o 75 % na $0.25, a právě tam u dlouhých agentických běhů leží úspora, ne na ceníkové ceně. Muse Spark 1.2 od Mety je uveden za $1.25 / $4.25, s úrovní Contributor za $0.10 / $0.20 pro každého, kdo je ochoten nechat Metu trénovat na svých promptech, a Grok 4.6 je uveden za $2 / $6, s výhradou, že prompt o 200 000 tokenech a více se přeúčtuje celý sazbou $4 / $12. Volba s nejlepším poměrem cena/výkon se v srpnu posunula, a ne proto, že by cokoli zlevnilo: DeepSeek 16. srpna zdražil oba modely V4 zhruba čtyřnásobně a zvedl V4-Flash 0731 z rovných $0.14 / $0.28 na $0.22 / $0.66 mimo špičku a $0.44 / $1.32 ve špičce. Volbou je nyní GLM 5.3 Flash s ceníkovými $0.15 / $0.50, do 9. září na polovinu, který má na Intelligence Index 57 a podbízí i tu mimošpičkovou sazbu DeepSeeku na obou stranách v kteroukoli denní hodinu. Přímo na frontier je nejvýhodnější volbou Grok 4.6 se skóre 61 za $0.84 na indexovou úlohu, kde Opus 5 stojí $2.34 a GPT-5.6 Sol si za stejné skóre po zlevnění z 21. srpna účtuje $4 / $20. Mezi uzavřenými modely je GPT-5.6 Luna nejlevnější za $0.20 / $1.20 po snížení OpenAI z 30. července. Podrobnější rozbor najdete v našem úplném průvodci srovnáním cen AI.

ModelVstup (za 1M)Výstup (za 1M)KontextPřístup zdarma?
GPT-5.5$5.00$30.001M (400K v Codex)ChatGPT Free; API placené
GPT-5.5 Pro$30.00$180.001MChatGPT Pro od $100/měs. (úroveň s vyšším použitím $200)
GPT-5.6 Sol$4.00$20.00NezveřejněnoŽivé v ChatGPT, Codex & API (9. července)
GPT-5.6 Terra$2.00$12.00NezveřejněnoŽivé v ChatGPT, Codex & API (9. července)
GPT-5.6 Luna$0.20$1.20NezveřejněnoŽivé v ChatGPT, Codex & API (9. července)
Claude Opus 5$5.00$25.001MVýchozí v Claude Pro/Max; API placené
Claude Opus 4.8$5.00$25.001MStarší model u Anthropicu; Pro/Max/API
Claude Fable 5.1$10.00$50.001MČtení z cache $0.25; v Max/Team Premium (~50 % limitů použití); Pro/Team Standard přes kredity. Mythos 5.1 se účtuje stejně, jen na pozvání
Claude Fable 5$10.00$50.001MTrvale v Max/Team Premium (~50 % limitů použití); Pro/Team Standard přes kredity
Claude Sonnet 5$2.00$10.001MVýchozí v Claude Free & Pro; API placené
Claude Sonnet 4.6$3.00$15.001MAPI placené (nahrazeno Sonnet 5)
Gemini 3.1 Pro$2.00 (≤200K) / $4.00 (>200K)$12.00 (≤200K) / $18.00 (>200K)1MOmezená aplikace Gemini; API placené
Gemini 3.7 Flash$0.75 úvodní / $1.50 od 1. 1. 2027$3.75 úvodní / $7.50 od 1. 1. 20271MAI Studio, Android Studio, Antigravity + placené API; v aplikaci Gemini jen přes Spark (AI Pro/Ultra, mimo EHP/UK/CH/Nigérii)
Gemini 3.6 Flash$0.75 úvodní / $1.50 od 1. 1. 2027$3.75 úvodní / $7.50 od 1. 1. 20271MVýchozí model bezplatné aplikace Gemini; AI Studio; bezplatná úroveň API + placené API
Gemini 3.5 Flash-Lite$0.30$2.501MAI Studio; bezplatná úroveň API + placené API
Qwen 3.7 Max$1.25 promo / $2.50 ceníková$3.75 promo / $7.50 ceníková1M200 dotazů zdarma/den; API placené nad rámec
MiniMax M3$0.30 (50 % z $0.60)$1.20 (≤512K)1MOpen weights; náklady na hosting
LongCat-2.0Závisí na poskytovateliZávisí na poskytovateli1MOpen weights (MIT); náklady na hosting
NVIDIA Nemotron 3 UltraZávisí na poskytovateliZávisí na poskytovateli1MOpen weights (OpenMDW); náklady na hosting
Qwen 3.5 (open-weight)Self-host / TogetherSelf-host / Together1MOpen weights; náklady na hosting
Nex-N2-ProSelf-host / poskytovateléSelf-host / poskytovatelé1MOpen weights (Apache 2.0); náklady na hosting
Rio 3.5 Open 397BSelf-host / poskytovateléSelf-host / poskytovatelé1MOpen weights (MIT); náklady na hosting
Grok 4.3$1.25$2.501MBezplatný spotřebitelský plán; API placené
Grok 4.6$2.00 (<200K) / $4.00 (≥200K)$6.00 (<200K) / $12.00 (≥200K)500KAPI SpaceXAI, Cursor, Grok Build, OpenRouter, Vercel, Cloudflare
Muse Spark 1.2$1.25 ($0.10 úroveň Contributor)$4.25 ($0.20 úroveň Contributor)1MPlacené API; Muse Code, Meta Model API a OpenRouter; úroveň Contributor mění práva k trénování za ~92% slevu
Kimi K3$3.00 ($0.30 cache-hit)$15.001MBezplatná základní úroveň v aplikaci Kimi; open weights na Hugging Face (Kimi K3 License)
Gemini Omni Flash (video)$1.50$17.50 (video výstup)10sekundové klipyAplikace Gemini / Flow; AI Studio + API
DeepSeek V4-Pro$0.66 mimo špičku / $1.32 ve špičce ($0.022 cache-hit mimo špičku)$1.98 mimo špičku / $3.96 ve špičce1MDeepSeek Chat zdarma; API placené, špičkové a mimošpičkové sazby od 16. srpna
DeepSeek V4-Flash 0731$0.22 mimo špičku / $0.44 ve špičce ($0.007 cache-hit mimo špičku)$0.66 mimo špičku / $1.32 ve špičce1MDeepSeek Chat zdarma; API placené, špičkové a mimošpičkové sazby od 16. srpna
Kimi K2.7 CodeZávisí na poskytovateliZávisí na poskytovateli256KOpen weights; náklady na hosting
GLM-5.2Závisí na poskytovateliZávisí na poskytovateli1MOpen weights; náklady na hosting
GLM 5.3$1.40 ($0.26 cache-hit)$4.401MZ.ai API, GLM Coding Plan a ZCode; váhy na Hugging Face od 28. srpna pod vlastní licencí GLM 5.3 License
GLM 5.3 Flash$0.15 ($0.03 cache-hit); $0.075 v akci$0.50; $0.25 v akci1MZ.ai API, GLM Coding Plan, OpenRouter; váhy pod MIT na Hugging Face; akce končí 9. září
Tencent Hy4 Preview$0.834 ($0.042 cache-hit)$2.5011M+Otevřené váhy (Apache 2.0); Tencent Cloud TokenHub, OpenRouter, WorkBuddy, CodeBuddy
Qwen3.8-Flash-NextPodle poskytovatelePodle poskytovatele262K (do 1M)Otevřené váhy (Qwen Community License 1.0); náklady na hosting se připočítávají
ERNIE 5.1Ceny pro region ČínaCeny pro region Čína256KBezplatná úroveň Baidu
Gemini Spark (agent)Bez ceny APIBez ceny API1M (základ Gemini)Google AI Ultra $99.99 nebo $199.99/měs.
Fello AI (agregátor)Směrováno přes aplikaciSměrováno přes aplikaciZávisí na modelu$9.99/měs., bezplatná verze dostupná

Výše uvedené sazby pro GPT-5.5 a GPT-5.5 Pro jsou ceny pro krátký kontext; OpenAI již specifické údaje pro dlouhý kontext nezveřejňuje. Úrovně GPT-5.6 se účtují za 2násobek vstupu a 1,5násobek výstupu, jakmile prompt přesáhne 272K vstupních tokenů, což dává long-context Terra na $4 / $18 a Luna na $0.40 / $1.80. Grok 4.6 funguje stejně, ale tvrději: od 200 000 tokenů v promptu výše přeúčtuje SpaceXAI celý požadavek vyšší sazbou, nikoli jen to, co limit přesahuje, takže překročení o tisíc tokenů zdvojnásobí cenu celého volání. Druhým ceníkem, který je třeba číst dvakrát, je DeepSeek: od 16. srpna se oba modely V4 účtují špičkovou sazbou od 01:00 do 04:00 a od 06:00 do 10:00 UTC ve všední dny a přesně poloviční v každou jinou hodinu, takže stejná úloha může stát dvojnásobek podle toho, kdy ji spustíte. Pokud chcete přístup k více AI modelům bez správy samostatných předplatných, Fello AI poskytuje GPT, Claude, Gemini, Grok, Perplexity a další v jediné aplikaci pro Mac, iPhone a iPad od $9.99/měsíc.

Open-weight modely

Nejlepší open-weight modely v září 2026

Nejlepším open-weight modelem v září 2026 je Kimi K3 a převzal vedení ve chvíli, kdy Moonshot 27. července 2026 zveřejnil váhy. Drží nejvyšší Intelligence Index ze všech open-weight modelů se skóre 60 na Artificial Analysis, sedm bodů před GLM-5.2, a na Areně je stále nejvýše umístěným otevřeným záznamem, na #2 ve WebDev (1,675.5) hned za Claude Opus 5 a #3 na žebříčku Agent. O tom, který z nich byste měli skutečně použít, rozhoduje jeden háček. Stažení K3 je 96 shardů safetensors a zhruba 1,56 TB, což potřebuje vícenodový GPU cluster místo pracovní stanice, a vychází pod vlastní licencí Kimi K3 License místo MIT. Praktickým doporučením pro týmy provozující vlastní váhy je tak nyní GLM 5.3 Flash (Z.ai, MIT), vydaný 26. srpna na Intelligence Index 57, o čtyři body více než GLM-5.2 a při méně než poloviční velikosti, 320B celkem s 18B aktivními. Je to první nativně multimodální model řady GLM-5, zvládá 1M kontext a váhy byly na Hugging Face pod MIT hned v den uvedení. GLM-5.2 (MIT) je záložní volba, na Intelligence Index 53, a stále drží nezávislý záznam, na který novější model zatím neměl čas, #6 na Arena WebDev (1,587.1) a #5 na žebříčku Agent. Třetí místo změnilo majitele poslední červencový den: DeepSeek V4-Flash 0731 byl dotrénován a skočil z Intelligence Index 40 na 52 na aktuálním indexu v4.1.1 pod MIT, jeho cena API však od té doby vzrostla zhruba čtyřnásobně, na $0.22 / $0.66 mimo špičku a $0.44 / $1.32 ve špičce. Měsíc pak uzavřela tři vydání a ani jedno z nich zatím nemá nezávislé hodnocení. GLM 5.3 konečně 28. srpna zveřejnil své váhy, přesně k datu, které neslo jeho zástupné místo, ale pod vlastní licencí GLM 5.3 License místo MIT, s klauzulí, podle níž musí každý provozovatel model-as-a-service s tržbami nad 10 miliard dolarů nejprve projít bezpečnostní revizí Z.ai; všimněte si také, že GLM 5.3 Flash není ořezaný GLM 5.3, ale samostatný model na nově natrénovaném základu, a právě proto mohl vyjít pod čistou MIT, zatímco vlajková loď nikoli. Tencent 28. srpna otevřel Hy4 Preview se 770B celkem a 49B aktivními pod Apache 2.0, zatím největší permisivně licencovaný zveřejněný model, opřený o interní slepé hodnocení, nikoli o nezávislý žebříček. A Alibaba 26. srpna zveřejnila Qwen3.8-Flash-Next, mixture-of-experts se 125B a pouhými 6B aktivními, který ukazuje architekturu Qwen4, pod licencí Qwen Community License 1.0 místo Apache. Všechny tři níže uvádíme, nikoli řadíme.

ModelNejlepší proKlíčový benchmarkKontext / LicenceKde spustit
Kimi K3Nejlépe hodnocený open-weight model, agentická a webová práceII 60, nejvyšší ze všech open-weight modelů; #2 Arena WebDev, #3 Arena Agent; 2.8T/104B aktivních1M / Kimi K3 LicenseHugging Face (96 shardů, 1.56 TB), Moonshot API, poskytovatelé
GLM 5.3 FlashNejlepší otevřený model, který si většina týmů skutečně dokáže provozovatII 57 (v4.1.1), na Paretově hranici poměru inteligence a ceny, zhruba $0.09 za úlohu indexu; 320B/18B aktivních, nativně multimodální1M / MITHugging Face, Z.ai API ($0.15/$0.50), OpenRouter
GLM-5.2Záložní volba s nezávislým záznamemII 53; #6 Arena WebDev (1,587.1), #5 Arena Agent; 744B/40B aktivních1M / MITZ.ai, Hugging Face, OpenRouter
GLM 5.3Otevřený od 28. srpna, ale pod vlastní licencíStejný základ 744B jako GLM-5.2, jen dotrénovaný, zveřejněný checkpoint počítán na 753B; CyberGym 84,5 % a Terminal-Bench 3.0 28,3 (údaje dodavatele)1M / GLM 5.3 License (model-as-a-service nad 10 mld. USD tržeb potřebuje bezpečnostní revizi Z.ai)Hugging Face, Z.ai API ($1.40/$4.40), GLM Coding Plan, ZCode
DeepSeek V4-Flash 0731Nejlepší otevřená hodnota, pokud si jej hostíte samiII 52 (v4.1.1), z 40 dne 31. července; 284B/13B aktivních1M / MITDeepSeek API ($0.22/$0.66 mimo špičku, $0.44/$1.32 ve špičce od 16. srpna), lokálně
Tencent Hy4 PreviewZatím největší permisivně licencovaný model770B/49B aktivních; 2,99/4,00 na vlastním panelu Tencentu se 203 úlohami proti 2,94 u Kimi K3 a 2,92 u GLM 5.3 (dodavatel); zatím bez nezávislého hodnocení1M+ / Apache 2.0Hugging Face (BF16 a FP8), Tencent Cloud TokenHub, OpenRouter
Qwen3.8-Flash-NextUkázka architektury Qwen4125B celkem plus N-gramové embedding s 51B, 6B aktivních; 91,7 GPQA Diamond a 62,5 SWE-Bench Pro (dodavatel); zatím bez nezávislého hodnocení262K až 1M / Qwen Community License 1.0Hugging Face, poskytovatelé, self-host
LongCat-2.0Frontier otevřený kodér trénovaný na čínských čipechII 33 (v4.1); 59,5 % SWE-Bench Pro (dodavatel), 1.6T/~48B aktivních1M / MITHugging Face, GitHub, OpenRouter
MiniMax M3Levný multimodální model třídy frontierII 44 (v4.1), 59 % SWE-Bench Pro, multimodální1M / licence TBDHugging Face, API $0.30/1M (50 % sleva)
Nex-N2-ProNejsilnější otevřené programátorské skóreII 41 (v4.1); 80,8 SWE-Bench Verified, 397B/17B aktivníchZaloženo na Qwen / Apache 2.0Hugging Face, poskytovatelé, self-host
Kimi K2.7 CodeNejsilnější komerčně licencovaný otevřený kodér+21,8 % na Kimi Code Bench v2 vs. K2.6 (dodavatel); 1T/32B aktivních256K / Modified MITHugging Face, DeepInfra, poskytovatelé
DeepSeek V4-ProAgentická práce v reálném světěII 44 (v4.1), 1.6T/49B aktivních1M / MITDeepSeek API ($0.435/$0.87), lokálně
Hy3Nejnovější účastník s permisivní licencíII 41 (v4.1); #22 na Arena WebDev (1,516.4)Apache 2.0Hugging Face, poskytovatelé, self-host
InklingPrvní open-weight model Thinking MachinesII 41 (v4.1), agentický 32,3, vydán 15. červenceOpen weightsHugging Face, poskytovatelé, self-host
Inkling SmallStejná rodina při čtvrtině velikostiII 40 (v4.1), agentický 30,8; 276B/12B aktivních, vstup text, obrázek a zvukApache 2.0Hugging Face (BF16 a NVFP4), poskytovatelé, self-host
NVIDIA Nemotron 3 UltraLaděno NVIDIA, plně permisivní licenceII 38 (v4.1), 65-70,4 SWE-Bench Verified, 550B/55B aktivních1M / OpenMDWOpenRouter, Hugging Face, AWS (8x B200 self-host)
Qwen 3.5 (397B / 17B aktivních)Multimodální, rychlé dekódování88,4 GPQA, 91,3 AIME 2026, 83,6 LiveCodeBench v61M / otevřenéTogether, OpenRouter, lokálně
Qwen3.6-35B-A3BEfektivní otevřený agentický kodér (3B aktivních)86,0 GPQA Diamond, 92,7 AIME 2026, 35B/3B aktivních262K (do 1M YaRN) / Apache 2.0Hugging Face, OpenRouter, lokálně
Qwen3.6-27BHustý kodér spustitelný na laptopu87,8 GPQA Diamond, hustý 27B, multimodální256K / Apache 2.0Lokálně Mac/PC, Hugging Face, OpenRouter
Rio 3.5 Open 397BFine-tune Qwen 3.5, vícejazyčné uvažování70,8 Terminal-Bench 2.1 (first-party), poráží Qwen 3.7 Plus na 4/5397B/17B aktivních / MITHugging Face, poskytovatelé, self-host
Llama 4 MaverickVlajkový model řady Meta17B aktivních / 400B celkových parametrůLlama 4 licenseCloud Meta, Hugging Face, lokálně
NVIDIA Nemotron 3 Nano OmniEdge / nízký výkonMultimodální, velmi malá stopaKompaktní / otevřenéLokálně, nástroj NVIDIA

Licencování zde záleží stejně jako holé skóre a srpen rozdíl mezi oběma skupinami ještě prohloubil. Kimi K2.7 (Modified MIT), DeepSeek V4 (MIT), GLM 5.3 Flash (MIT), GLM-5.2 (MIT), LongCat-2.0 (MIT), Hy3 (Apache 2.0), Hy4 Preview (Apache 2.0), Nex-N2-Pro (Apache 2.0) a Nemotron 3 Ultra (OpenMDW) všechny jasně umožňují komerční použití bez zkoumání tržeb. Zbytek nese podmínky, které je vhodné si přečíst dřív, než na nich začnete stavět: MiniMax M3 a MiniMax H3 vycházejí pod vlastními komunitními licencemi, přičemž H3 navíc vyžaduje žádost z USA, EU, Spojeného království a Jižní Koreje; Kimi K3 sedí na vlastní licenci s prahem tržeb pro každého, kdo jej přeprodává jako službu; GLM 5.3 vyžaduje bezpečnostní revizi Z.ai u každého provozovatele model-as-a-service s tržbami nad 10 miliard dolarů; a Qwen Community License 1.0 u Qwen3.8-Flash-Next vyžaduje samostatnou licenci od Qwenu pro provozování model-as-a-service nebo produktu typu AI pracovní asistent, byť interní použití je vyňato. Žádný open-weight model už není první na žádném žebříčku Areny, který sledujeme: Claude Opus 5 vzal žebříček Agent v červenci, poslední, který open-weight model vedl.

Jak hodnotíme

Benchmarky, ceny a praktické používání

Každé hodnocení na této stránce kombinuje tři vstupy: veřejné benchmarky od sedmi nezávislých firem (Artificial Analysis, Arena dříve LMArena, Scale SEAL, LiveBench, EQ-Bench, ARC Prize a oficiální žebříček Terminal-Bench 2.1, pokrývající indexy Intelligence a Agentic, GPQA Diamond, ARC-AGI-1 až 3, Humanity's Last Exam, GDPval-AA, FrontierMath, HMMT, MCP Atlas, SWE Atlas a Remote Labor Index), zveřejněné ceny API a předplatného z oficiální cenové stránky každého dodavatele a praktické používání redakčním týmem FelloAI, který spouští reálné prompty na téže úloze na každém modelu. Oficiální zdroje cen a benchmarků znovu načítáme před každou měsíční aktualizací.

Benchmarky jsou váženy podle případu použití: SWE-bench a Terminal-Bench pohánějí programování, GPQA Diamond a ARC-AGI-2 pohánějí přesnost, GDPval-AA (benchmark profesionálních výstupů od Artificial Analysis) informuje kvalitu profesionálních úloh, zatímco styl psaní se posuzuje primárně praktickým testováním, FrontierMath a HMMT pohánějí řešení problémů. Zveřejňujeme, když je benchmark hlášen dodavatelem, ale nezávisle neověřen, a vyřazujeme každé tvrzení, které nedokážeme reprodukovat proti živému zdroji. Nehýbeme korunou kategorie na síle jediného žebříčku, a když je nový model příliš čerstvý na to, aby jej žebříčky lidských preferencí ohodnotily, řekneme to, místo abychom jej korunovali jen na skóre benchmarků. Když model mezi aktualizacemi projde velkým upgradem, kategorii přehodnotíme a přidáme řádek „Co se tento měsíc změnilo“ na konec podrobné analýzy.

Fello AI běžící na Macu, iPhonu a iPadu
Nevíte, který model zvolit?

Fello AI spojuje špičkové AI modely v jedné odlehčené nativní aplikaci.

Přepínejte mezi nimi kdykoli, žádná samostatná předplatná.

Stáhnout Fello AI
Často kladené dotazy

Časté dotazy

Jaký je nejlepší AI model právě teď v září 2026?
Záleží na úloze. V celkovém skóre benchmarků je Claude Fable 5.1 (1. září) #1 na Intelligence Index od Artificial Analysis se skóre 66 a jeho Agentic Index se skóre 61, s Claude Opus 5 druhým na obou se skóre 63 a 59; Arena ohodnotila Opus 5 na vrcholu čtyř svých žebříčků, včetně obou programátorských, a pro Fable 5.1 zatím nemá hlasy. Grok 4.6 (12. srpna) je nejvýhodnější volbou na frontier, dělí se o skóre 61 s GPT-5.6 Sol za třetinovou cenu. Pro každodenní chat je GPT-5.6 výchozím modelem ChatGPT od 9. července a asistentem, kterého většina lidí skutečně otevře, ačkoli Claude Fable 5 vede textový žebříček Areny. Pro programování je Claude Opus 5 #1 na žebříčcích WebDev (1,702.9) a image-to-WebDev (1,668.6) Areny za poloviční cenu oproti Fable 5. Pro psaní je Claude Fable 5 #1 na textovém žebříčku Areny (1508.6), přičemž Fable 5.1 je před ním na Humanity's Last Exam (59,1 %) a vyrovnaný s ním na AA-Omniscience (43). Pro přesnost vyrovnává Gemini 3.1 Pro lidský panel na ARC-AGI-1 se skóre 98 % za $0.52 na úlohu. Pro těžkou matematiku a uvažování je GPT-5.6 Sol #1 na LiveBench Mathematics, LiveBench Reasoning a ARC-AGI-2. Pro obrázky vede ChatGPT Images 2.0 oba žebříčky a pro video vede Gemini Omni Flash oba. Pro agenty je Gemini Spark cloudový agent 24/7 a Claude Cowork desktopový.
Co je Claude Opus 5?
Claude Opus 5 je vlajkový model Anthropicu z 24. července 2026 a byl #1 modelem na Artificial Analysis, dokud 1. září nedorazil Claude Fable 5.1. Nyní je druhý na Intelligence Index se skóre 63 proti 66, druhý na Agentic Index se skóre 59 proti 61 a druhý na žebříčku GDPval-AA v2 pro profesionální výstupy se skóre 1824 proti 1853, stále výrazně před 1755 od Grok 4.6 a 1723 od Claude Fable 5. Ceny API jsou $5 / $25 za 1M tokenů, stejné jako Opus 4.8 a poloviční oproti Fable 5, s kontextovým oknem 1M tokenů a znalostním cutoff z května 2026. ARC Prize nezávisle potvrzuje uváděcí tvrzení Anthropicu k ARC-AGI-3, kde Opus 5 dosahuje 30 % proti 8 % u dalšího nejlepšího modelu, zhruba 3,75násobek. Arena jej od té doby ohodnotila a řadí jej na #1 ve WebDev, image-to-WebDev, Document a na žebříčku Agent a na #6 v textu, a to je to, co mu přisoudilo programátorskou korunu. Jedna věc, kterou mít na paměti: Artificial Analysis měří jeho míru halucinací na 50 %, což je důvod, proč na této stránce nedrží žádnou korunu za přesnost.
Co je Claude Fable 5.1?
Claude Fable 5.1 je vydání Anthropicu z 1. září 2026 a nejvýše hodnocený model, jaký kdy Artificial Analysis naměřil, se skóre 66 na Intelligence Index při nastavení max effort a 61 na Agentic Index. Vyšel spolu s Claude Mythos 5.1, což je tentýž model s uvolněnými pojistkami v biologii a kybernetické bezpečnosti, dostupný jen na pozvání a bez zveřejněných kritérií způsobilosti. Ceny jsou $10 / $50 za 1M tokenů, stejné jako u Fable 5, ale čtení z cache klesá o 75 % na $0.25, s kontextovým oknem 1M tokenů a znalostním cutoff z června 2026. Je zahrnutý v Claude Max a Team Premium zhruba na 50 % týdenních limitů a z Pro je dosažitelný přes kredity. Anthropic stále doporučuje začít pro většinu zátěží s Claude Opus 5, protože stojí polovinu a běží rychleji. Náš úplný rozbor Claude Fable 5.1 a Mythos 5.1 pokrývá systémovou kartu i rozdělení pojistek.
Je Claude Fable 5 zpět?
Ano. Anthropic znovu nasadil Claude Fable 5 dne 1. července 2026 poté, co vláda USA zrušila exportní omezení, které uvalila 12. června. Je opět dostupný na Claude API, Claude.ai, Claude Code a Claude Cowork. Anthropic učinil Fable 5 v placených plánech trvalým 20. července 2026. Max a Team Premium jej zahrnují zhruba na 50 % běžných limitů použití; Pro a Team Standard k němu dosáhnou přes kredity použití s jednorázovým startovním kreditem $100. Ceny API jsou $10 / $50 za milion tokenů. Fable 5 je model třídy Mythos postavený pro dlouhodobou agentickou práci s kontextem 1M tokenů a je druhý pro programování za Claude Opus 5, na #2 na žebříčku image-to-WebDev Areny (1,625.7) a #4 ve WebDev.
Co je GPT-5.6 a mohu jej používat?
Ano, od 9. července 2026. GPT-5.6 je rodina modelů OpenAI nové generace a po dvoutýdenním uzavřeném náhledu, který začal 26. června za bezpečnostní prověrkou vlády USA, dosáhla obecné dostupnosti 9. července. Existují tři úrovně, od nejméně po nejschopnější: Luna, rychlá, nejlevnější úroveň ($0.20 / $1.20 za 1M tokenů); Terra, vyvážený každodenní model, o němž OpenAI říká, že se vyrovná GPT-5.5 ($2 / $12); a Sol, vlajkový model laděný pro biologii, chemii a kyberbezpečnost ($4 / $20). OpenAI snížil Lunu o 80 % a Terru o 20 % dne 30. července 2026 a Sol nechal beze změny, poté 21. srpna 2026 snížil Sol o více než 20 % jako propagační sazbu zhruba na tři měsíce. Žádná cena předplatného ChatGPT se nezměnila. Nyní je živý napříč ChatGPT, Codex a API jako výchozí model OpenAI. Jedna výhrada: system card OpenAI a externí hodnotitel METR upozornili na zvýšené chování „scheming“ u Sol, takže s ním u faktografické práce s vysokou odpovědností zacházejte opatrně, dokud se nezávislé výsledky neustálí.
Je už Grok 4.6 venku?
Ano. SpaceXAI vydala Grok 4.6 dne 12. srpna 2026 a nahradila jím Grok 4.5 jako vlajkový model necelý měsíc a půl po jeho uvedení. Nejde o nový základový model: společnost ponechala základ z Grok 4.5 a model zlepšila dalším dotrénováním, včetně posilovaného učení v agentických prostředích, a nezveřejnila žádnou novou architekturu ani počet parametrů. Artificial Analysis jej hodnotí na Intelligence Index 61, o pět bodů výš než Grok 4.5 se skóre 56, čímž se vyrovnává GPT-5.6 Sol se skóre 61, za Claude Fable 5.1 se skóre 66, Claude Opus 5 se skóre 63 a Claude Fable 5 se skóre 62. Ceny zůstávají nezměněné na $2 / $6 za 1M tokenů s kontextovým oknem 500K tokenů, i když prompty od 200 000 tokenů výše se přeúčtují celé sazbou $4 / $12. Model je živý v API SpaceXAI, v Cursoru, Grok Build, na OpenRouter, Vercelu a Cloudflare. Grok 4.6 je také naší volbou pro kreativitu, z produktových důvodů, ne kvůli kvalitě prózy; pro nejlépe napsaný výstup vyhrává Claude Fable 5 naprosto. Úplná čísla najdete v našem rozboru Grok 4.6.
Která AI je nejlepší na programování?
Claude Opus 5 je nejlepší na programování a vyhrává dva žebříčky, kde vývojáři hlasují o výsledku, spíše než harness spouští skript: #1 na žebříčku WebDev Areny (1,702.9) a #1 v image-to-WebDev (1,668.6), k hlasovacím hranicím 1. srpna a 31. července. Běží $5 / $25 za 1M tokenů, poloviční oproti Claude Fable 5, a vlastní dokumentace Anthropicu radí začít s Opus 5 pro komplexní agentické programování. Claude Fable 5 je druhý pro nejtěžší dlouhodobé úlohy na #2 image-to-WebDev a #4 WebDev a Kimi K3 je kandidátem na #2 ve WebDev (1,675.5). Vezměte na vědomí, že Coding Index od Artificial Analysis není zametení Claudem: GPT-5.6 Sol (xhigh) jej vede se skóre 78,3 s Opus 5 na 78,0, dost blízko na remízu. GLM 5.3 Flash (MIT, 26. srpna) je nyní jak volbou s nejlepším poměrem cena/výkon za $0.15 / $0.50, tak nejlepším open-weight kodérem, kterého si můžete hostit sami, na Intelligence Index 57; první z toho převzal od DeepSeek V4-Flash 0731 ve chvíli, kdy DeepSeek 16. srpna zdražil zhruba čtyřnásobně.
Která AI je nejlepší na psaní?
Claude Fable 5 je nejlepší na psaní a je to jediný model v první trojce všech tří nezávislých žebříčků pro psaní: #1 na Arena tvůrčí psaní, #1 na LiveBench Language (90.7) a #3 na EQ-Bench Creative Writing v3. Stojí $10 / $50 za 1M tokenů. Claude Sonnet 5 je volba s nejlepším poměrem cena/výkon a to, co by většina lidí měla skutečně použít, protože je zdarma a výchozí na claude.ai za $2 / $10, úvodní sazbu, kterou Anthropic v srpnu 2026 učinil trvalou, ačkoli se řadí na #53 na Arena tvůrčí psaní. Kimi K3 vyhrává EQ-Bench naprosto se skóre 2377, pokud chcete osobitou beletrii, Claude Fable 5.1 kraluje žebříčku GDPval-AA v2 pro profesionální výstupy se skóre 1853 s Claude Opus 5 druhým se skóre 1824, GPT-5.5 je alternativa pro faktograficky ukotvené obchodní psaní a Gemini 3.6 Flash je volba s nejlepším poměrem cena/výkon pro hromadný obsah.
Jaký je nejlepší open-weight AI model v roce 2026?
Kimi K3 je právě teď nejlepší open-weight model a je jím od chvíle, kdy Moonshot 27. července 2026 zveřejnil váhy. Má nejvyšší Intelligence Index ze všech open-weight modelů se skóre 60 na Artificial Analysis a na Areně je #2 ve WebDev a #3 na žebříčku Agent. Háček je v tom, že je to 96 shardů a zhruba 1,56 TB pod vlastní licencí Kimi K3 License, takže GLM 5.3 Flash (26. srpna, MIT) je nyní modelem, který si většina týmů skutečně dokáže hostit, na Intelligence Index 57 a s 320B celkem a 18B aktivními parametry. Třetí je DeepSeek V4-Flash 0731, který 31. července skočil z Intelligence Index 40 na 52 beze změny velikosti nebo licence, DeepSeek však 16. srpna zdražil své API zhruba čtyřnásobně, na $0.22 / $0.66 mimo špičku a $0.44 / $1.32 ve špičce, což jej stálo volbu s nejlepším poměrem cena/výkon. GLM 5.3, vydaný 14. srpna, je jiný a větší model, jehož váhy 28. srpna dorazily, ale pod vlastní licencí GLM 5.3 License místo MIT. Měsíc uzavřely další dva otevřené modely, zatím bez nezávislého hodnocení: Hy4 Preview od Tencentu 28. srpna, 770B pod Apache 2.0 a zatím největší permisivně licencovaný model, a Qwen3.8-Flash-Next od Alibaby 26. srpna, ukázka architektury Qwen4 pod licencí Qwen Community License 1.0. Upřímně stojí za to vědět, že žádný open-weight model už není první na žádném žebříčku Areny, který sledujeme.
Jaký je nejlevnější AI model třídy frontier?
V cenách API za milion tokenů je GPT-5.6 Luna nyní nejlevnějším uzavřeným modelem třídy frontier za $0.20 / $1.20 poté, co jej OpenAI 30. července 2026 snížil o 80 %, a Artificial Analysis jej hodnotí na Intelligence Index 52 na svém indexu v4.1.1, na stejné úrovni jako Gemini 3.6 Flash. Ještě levnější je GLM 5.3 Flash, naše volba s nejlepším poměrem cena/výkon od srpna, s ceníkovými $0.15 / $0.50 a poloviční sazbou do 9. září, se skóre 57 na Intelligence Index a pod čistou licencí MIT, kterou si můžete hostit sami. DeepSeek V4-Flash 0731 tuto volbu držel do chvíle, kdy DeepSeek 16. srpna zdražil zhruba čtyřnásobně, na $0.22 / $0.66 mimo špičku a $0.44 / $1.32 ve špičce. Levná úroveň od Googlu se v srpnu výrazně zlepšila v poměru cena/výkon: Gemini 3.7 Flash má skóre 56 za úvodních $0.75 / $3.75, ačkoli se tato sazba 1. ledna 2027 zdvojnásobí. MiniMax M3 je nyní uveden za $0.30 za milion vstupních tokenů na trvalé 50% slevě, s LongCat-2.0 jako silnou alternativou pod MIT. Qwen 3.7 Max za $1.25 / $3.75 na jeho aktuální promo je výhodná volba na Intelligence Index 46, ačkoli Luna jej nyní podbízí jak cenou, tak skóre.
Které AI modely jsou zdarma?
ChatGPT Free nyní ve výchozím nastavení používá GPT-5.6 (s GPT-5.5 stále dostupným) v rámci limitů použití. Gemini Free spouští Gemini 3.6 Flash v aplikaci Gemini a Google AI Studio. Claude Free spouští Claude Sonnet 5 (nový výchozí) s denními limity. DeepSeek Chat spouští DeepSeek V4 zdarma na webu DeepSeeku. Grok má omezený bezplatný spotřebitelský plán (X Premium je placený doplněk). Qwen 3.5, Qwen3.8-Flash-Next, NVIDIA Nemotron 3 Ultra, MiniMax M3, LongCat-2.0, Kimi K2.6, DeepSeek V4, GLM-5.2, GLM 5.3, GLM 5.3 Flash a Hy4 Preview od Tencentu jsou open-weight a zdarma k self-hostingu, licence se však liší a jen část z nich je čistá MIT nebo Apache. Qwen 3.7 Max je jen API bez spotřebitelského chatovacího rozhraní, ale Alibaba nyní zahrnuje 200 dotazů na model zdarma denně. Kimi má bezplatnou základní úroveň ve své aplikaci, s měřeným náročnějším agentickým použitím.
Co je Gemini Spark a stojí za $99.99/měsíc?
Gemini Spark je první AI agent Googlu běžící v cloudu 24/7, uvedený na Google I/O dne 19. května 2026 a exkluzivní pro plán Google AI Ultra, který Google přestrukturoval tak, aby zahrnoval vstupní úroveň za $99.99/měsíc a nejvyšší úroveň za $199.99/měsíc. Spark je postaven na základních modelech Gemini s harnessem Antigravity od Googlu na Google Cloud VM, integruje se s Gmailem, Google Docs a dalšími aplikacemi Google Workspace a na straně zařízení dokáže interagovat s Chromem a systémem Halo pro Android. Za tu výdaji stojí pro uživatele, kteří mají opakovatelné dlouhoběžící workflow (třídění schránky, souhrny výzkumu, plánované úlohy). Pro jednorázové úlohy pokryje Claude Cowork za $20/měsíc většinu potřeb desktopového agenta.
Co je Fello AI?
Fello AI je AI chatbot pro Mac, iPhone a iPad, který vám umožní používat všechny top AI modely jako ChatGPT, Claude, Gemini, Grok a DeepSeek v jedné aplikaci, s modely pravidelně aktualizovanými, takže máte vždy ty nejnovější. Stojí $9.99/měsíc s hodnocením 4,7 hvězdičky napříč 27 000+ recenzemi.
Jak často tuto stránku aktualizujete?
Tuto stránku aktualizujeme minimálně měsíčně a do 24-48 hodin od každého většího uvedení modelu.
Související články
Claude vs. ChatGPT: která AI je v roce 2026 opravdu lepší?

Claude se počátkem roku 2026 dostal na #1 v App Store a poprvé vytlačil ChatGPT ze špičky. Spouštěčem bylo veřejné odmítnutí Anthropicu vyhovět požadavku Pentagonu nasadit jeho modely pro autonomní zbraně.

Číst dál →
Grok vs. ChatGPT: který AI chatbot je v roce 2026 opravdu lepší?

Oba chatboti právě přešli na nové vlajkové modely. ChatGPT nyní běží na GPT-5.6 (úrovně Sol, Terra, Luna) a Grok pohání Grok 4.6, vydání SpaceXAI z 12. srpna, které se na Intelligence Index dělí o skóre se Sol za třetinovou cenu.

Číst dál →
ChatGPT vs. Gemini v roce 2026: kterou AI byste měli opravdu používat?

ChatGPT přešel na GPT-5.6 jako svůj vlajkový model, zatímco Gemini 3.1 Pro zůstává placeným vlajkovým modelem Googlu. Přímé srovnání napříč psaním, programováním, obrázky a cenou.

Číst dál →
Kdy použít kterou AI: vyberte správný model

Žádná jediná AI není nejlepší na všechno. Přiřaďte úkol modelu, který v něm vede, podle tabulky pro kódování, psaní, rešerše i běžný chat.

Číst dál →
Nejlepší AI agenti v roce 2026: 30 nástrojů otestováno

Třicet AI agentů srovnaných podle toho, co s nimi chcete dělat: kódování, rešerše, kancelářská práce a automatizace, včetně cen a bezplatných možností.

Číst dál →
Gemini Nano Banana Pro vs. GPT-Image-1.5: dokonalé srovnání

Naše původní praktické srovnání z prosince 2025 dvou vedoucích modelů pro generování obrázků, se skutečnými ukázkami výstupů vedle sebe.

Číst dál →

Vyzkoušejte každý model.
Jedna krásná aplikace.

Každý model z tohoto průvodce v jedné nativní aplikaci: ChatGPT, Claude, Gemini, Grok a DeepSeek. Začněte zdarma.

Fello AI běžící na Macu, iPadu a iPhonu

Hodnocení 4,7·27 000+ recenzí·Začněte zdarma