OpenAI právě zveřejnilo svůj průvodce promptováním pro GPT-5.6 a klíčové zjištění převrací to, jak většina lidí prompty píše. Ve vlastních testech OpenAI odstranění opakujících se instrukcí ze systémového promptu zvýšilo skóre hodnocení přibližně o 10 až 15 %, zatímco celkový počet tokenů klesl o 41 až 66 % a náklady o 33 až 67 %. Obrovské seznamy pravidel, které jste psali pro starší modely, teď GPT-5.6 zpomalují, zdražují a snižují jeho přesnost.

Tento průvodce promptováním GPT-5.6 shrnuje sedm nejdůležitějších změn srozumitelně. Dozvíte se, proč „každou instrukci napište jednou" porážívá dlouhé zásobníky pravidel, jak si vybrat mezi novými modely Sol, Terra a Luna, jak funguje šest úrovní reasoning effort a jak nové možnosti jako verbosity a programmatic tool calling ovlivňují to, co byste měli psát. Vše vychází z oficiálního průvodce OpenAI pro rodinu modelů, která byla spuštěna 9. července 2026.

Klíčová zjištění

  • Stručnější prompty dosáhly o 10 až 15 % vyššího skóre a snížily počet tokenů až o 66 %, proto každou instrukci napište přesně jednou.
  • GPT-5.6 má dva nezávislé ovladače: který model (Sol, Terra nebo Luna) a jak intenzivně přemýšlí (šest úrovní effort od none po max).
  • Pro mode přidává před jedinou závěrečnou odpovědí extra výpočetní kapacitu a lze ho kombinovat s jakoukoli úrovní effort pro nejdůležitější požadavky.
  • GPT-5.6 je ve výchozím nastavení stručnější než GPT-5.5, takže vaše stará pravidla „buď krátký" mohou nyní zkracovat příliš.
  • Nové funkce verbosity a programmatic tool calling umožňují nastavit délku jednou a nechat model zpracovávat data v kódu místo čtení token po tokenu.

Co se v GPT-5.6 skutečně změnilo

Od vydavatele

Každý AI model v jedné aplikaci

Fello AI přináší GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 a další v jedné nativní aplikaci pro Mac a iPhone.

Stáhnout hned!

GPT-5.6 není jeden model, ale rodina tří, a je naladěn přemýšlet jinak než předchozí verze. Největší praktickou změnou je, že model dokáže více s méně instrukcemi, takže prompty optimalizované pro GPT-5.5 nebo GPT-5.4 mohou vaše výsledky aktivně zhoršovat. Pokyny OpenAI jsou v tom přímé: doporučují prověřit staré prompty místo toho, abyste je jen zkopírovali.

Sedm tipů níže sleduje vlastní priority OpenAI a začíná změnou, která nejvíce posouvá skóre. Chcete-li nejprve přehled spuštění tří modelů, přečtěte si náš výklad ChatGPT 5.6 a čím se Sol, Terra a Luna liší. Pak se vraťte sem a opravte své prompty.

Tip 1: Smažte opakující se instrukce ze starých promptů

Nejsilnějším doporučením OpenAI je uvádět každou instrukci přesně jednou. Citací jejich slov: „konfigurace se stručnějšími systémovými prompty zlepšily skóre hodnocení přibližně o 10 až 15 % a zároveň snížily celkový počet tokenů o 41 až 66 % a náklady o 33 až 67 %." Je to vzácný případ, kdy zároveň snížíte náklady a zvýšíte kvalitu.

Starší modely často potřebovaly totéž pravidlo uvést na třech místech, aby ho dodržely. GPT-5.6 to nepotřebuje. Odstraňte opakující se tvrzení, zdvojená stylistická pravidla, nadbytečné příklady a procesní pokyny, které nemění výsledné chování. Každá věta, která nepřidává novou informaci, nyní snižuje přesnost i spotřebu tokenů.

Praktický postup: otevřete svůj nejdelší systémový prompt a smažte každou větu, která opakuje dřívější. Ponechejte jednu jasnou verzi každého pravidla a otestujte. To je nejrychlejší přínos v celém průvodci promptováním GPT-5.6 od OpenAI.

Tip 2: Přizpůsobte výpočetní kapacitu úloze pomocí dvou ovladačů

GPT-5.6 rozděluje schopnosti do dvou nezávislých ovladačů. Jeden určuje, do jaké velikosti modelu požadavek posíláte, druhý, jak intenzivně model před odpovědí přemýšlí. Správné nastavení obou zabraňuje tomu, abyste přepláceli za jednoduché úlohy nebo věnovali málo výpočetní kapacity těm složitým.

Výběr modelu: Sol, Terra nebo Luna

Sol je vlajkový model pro nejtěžší problémy, Terra je vyvážený tahoun pro každodenní firemní práci a Luna je levná a rychlá volba pro úlohy s velkým objemem. Cenový rozdíl je výrazný, takže výběr modelu je stejně důležitý jako samotný prompt. OpenAI rozdíly zvětšilo 30. července 2026: Luna zlevnila o 80 % a Terra o 20 % v rámci API, přičemž Sol zůstalo na $5 / $30. Správné přiřazení úlohy ke správné úrovni nyní šetří více než při spuštění.

ModelNejlépe proCena za 1M tokenů (vstup / výstup)
SolNejtěžší problémy: složité kódování, vícekrokové agenty, výzkum$5 / $30
TerraKaždodenní firemní práce, vyvážená kvalita a cena$2 / $12
LunaLevná, rychlá práce s velkým objemem: souhrny, koncepty$0.20 / $1.20

Sol: vlajkový model pro těžké problémy

Sol je určen pro nejnáročnější práci, včetně složitého kódování, vícekrokových agentů a vědeckého nebo bezpečnostního výzkumu. Při ceně $5 za vstup a $30 za výstup na milion tokenů je to nejdražší úroveň, proto ho rezervujte pro problémy, které skutečně vyžadují špičkové uvažování. Sol je také model, který spouští pro mode a nejhlubší max effort, takže se vyplatí právě zde.

Terra: každodenní tahoun

Terra je vyvážená produkční úroveň, srovnatelná s předchozí generací za o 60 % nižší cenu. Při $2 za vstup a $12 za výstup na milion tokenů, po snížení o 20 % od 30. července 2026, zvládá většinu firemního psaní, analýz a zákaznické podpory bez příplatku za Sol. Pro většinu týmů se stane výchozím modelem, jakmile ho otestují na reálných úlohách a přesvědčí se, že kvalita obstojí.

Luna: rychlá a dostupná

Luna je levná varianta pro velké objemy za $0.20 za vstup a $1.20 za výstup na milion tokenů, poté co ji OpenAI 30. července 2026 zlevnilo o 80 %. Je určena pro rutinní automatizaci jako souhrny, koncepty a klasifikace, kde záleží více na rychlosti a ceně než na maximálním výkonu. Nejjednodušší a nejčastější úlohy směřujte sem, aby náklady zůstaly nízké.

Doporučení OpenAI pro výběr modelu navrhuje začít se Sol jako základem, pak otestovat, zda Terra nebo Luna obstojí na vašich reálných úlohách. Mnoho každodenních úloh běží stejně dobře na Terra za o 60 % méně než Sol a Luna nyní stojí pětadvacetinu Sol u vstupu i výstupu. Kde všechny tři stojí vůči konkurenci, uvidíte v našem přehledu nejlepších AI modelů právě teď.

Nastavení reasoning effort

Druhý ovladač je reasoning effort a GPT-5.6 nabízí šest úrovní. OpenAI doporučuje začít na úrovni, kterou jste používali u předchozího modelu, a pak vyzkoušet o jednu nižší, protože nová generace obvykle potřebuje méně přemýšlení ke stejné odpovědi.

Úroveň effortKdy ji použít
noneJednoduché vyhledávání, kde záleží hlavně na rychlosti odezvy
lowLehká práce citlivá na rychlost
mediumVyvážené výchozí nastavení pro většinu úloh
highKdy testy ukáží měřitelný přínos pro kvalitu
xhighNáročnější úlohy, které zjevně těží z hlubšího uvažování
maxNejtěžší problémy, kde kvalita je na prvním místě

Snížení o jednu úroveň často ušetří peníze bez ztráty kvality, proto OpenAI testování nižší úrovně uvádí jako výchozí zvyk. Nejvyšší úrovně si nechte pro ty pár problémů, které je skutečně potřebují.

Tip 3: Pro nejdůležitější odpovědi zapněte pro mode

GPT-5.6 přináší skutečný pro mode a je to ovladač, po němž sáhnete, když kvalita převáží nad rychlostí nebo cenou. V Responses API nastavíte reasoning.mode na pro a model před vrácením jediné závěrečné odpovědi věnuje požadavku extra výpočetní kapacitu. Funguje navíc k jakémukoli modelu a úrovni effort, které jste již nastavili.

Nezaměňujte pro mode s max effort. Max je nejvyšší ze šesti úrovní effort a dává jednomu řetězci uvažování více času na jediný problém se skrytými závislostmi nebo nepřehledným kontextem. Pro mode přidává samostatné kolo práce modelu před závěrečnou odpovědí a lze ho kombinovat s jakoukoli úrovní effort od low po max. Pro mode si nechte pro tu malou skupinu požadavků, kde je chybná odpověď skutečně nákladná.

Pro práci, která je skutečně paralelizovatelná, nabízí ChatGPT a Codex také ultra mode, který úlohu rozloží a spustí koordinující subagenty místo jednoho řetězce. To posunulo Sol z 88,8 % na 91,9 % v benchmarku kódování Terminal-Bench 2.1, ale každý subagent samostatně spotřebovává tokeny, takže ultra je pro rutinní požadavky zbytečné. Použijte ho jen tehdy, když se úloha čistě rozdělí a záleží na rychlosti výsledku. Upozornění pro ty, kdo spouštějí Codex lokálně na Macu: samostatná chyba logování, známá jako Codex SSD bug, zapisovala terabajty diagnostických dat na disk, než OpenAI dodalo většinu opravy v červnu 2026.

Tip 4: Přepište pravidla „buď stručný"

GPT-5.6 ve výchozím nastavení odpovídá kratšími odpověďmi než GPT-5.5. To znamená, že plošná pravidla stručnosti, která jste přidávali pro starší modely, mohou nyní zkracovat příliš, takže přijdete o detail, který jste vlastně chtěli. OpenAI přímo upozorňuje migrující uživatele, aby zkontrolovali, zda „be concise" nebo „keep it short" stále plní svůj účel.

Chcete-li krátkou odpověď, přestaňte zadávat neurčité příkazy ke stručnosti. Řekněte modelu, které informace ponechat a které detaily může vynechat. Instrukce jako „ponech cenu a termín, vynech historii na pozadí" vám dává kontrolu, kterou „buď stručný" nikdy neposkytne.

Tip 5: Tón popište jako konkrétní chování, ne přídavná jména

Slova jako „přátelský" a „empatický" jsou příliš abstraktní na to, aby přinášela konzistentní výsledky. GPT-5.6 reaguje mnohem lépe, když popíšete konkrétní způsob psaní, který požadujete. Uveďte, jak přímé to má být, čím začít a co vynechat.

Vlastní příklad OpenAI nahrazuje „buď empatický" konkrétní instrukcí: odpovězte přímo a pokud uživatel hlásí problém, nejprve ho pojmenujte, pak teprve dejte další krok. Prompt pro zákaznickou podporu by mohl znít: „v prvním řádku pojmenujte problém zákazníka, řešení uveďte jako číslované kroky, omluvu vynechejte." Konkrétní instrukce zaručují stejný tón pokaždé, což je přesně to, co týmy oceňují při porovnávání možností jako Claude vs ChatGPT pro reálné pracovní postupy.

Tip 6: Délku výstupu nastavte jednou pomocí ovladače verbosity

Délka výstupu je nyní samostatný ovladač. GPT-5.6 přidává nastavení verbosity s možnostmi low, medium a high, které nastavíte jednou pro celou aplikaci místo toho, abyste v každém promptu žadonili o kratší odpovědi. V API jde o parametr text.verbosity.

Čistý vzor je nastavit výchozí úroveň podrobnosti přes verbosity a v promptu uvádět pouze požadavky na délku specifické pro danou úlohu. Prompty tak zůstanou zaměřené na úlohu, zatímco jeden globální ovladač řídí, jak moc model říká. Malá změna, která odstraní spoustu opakovaných instrukcí k délce.

Tip 7: Nechte GPT-5.6 psát kód pro práci s nástroji

Tento tip je pro vývojáře. GPT-5.6 přichází s funkcí programmatic tool calling, která mění ekonomiku datově náročných úloh. Dosud byl každý výsledek nástroje vrácen modelu ke čtení slovo po slovu, takže „zkontroluj 900 řádků dat o reklamách" znamenalo, že model přečetl všech 900 řádků.

Nyní může model místo toho napsat malý program v JavaScriptu. Skript běží v izolovaném prostředí bez přístupu k síti, načte data, provede filtrování a výpočty v kódu a vrátí pouze malý strukturovaný výsledek. Těch 900 řádků se k modelu vůbec nedostane, takže odpovědi přicházejí rychleji za zlomek nákladů. Funguje nejlépe pro ohraničené úlohy jako filtrování, spojování, řazení, odstraňování duplicit a agregace výsledků nástrojů.

OpenAI varuje před neurčitými instrukcemi jako „use programmatic tool calling efficiently." Raději popište ohraničenou fázi, způsobilé nástroje, výstupní schéma, limit opakování a podmínku zastavení. Přímé volání modelu ponechejte pro sémantické úsudky, schválení a citace; kód nechte zvládnout deterministickou těžkou práci.

Musíte přepsat každý prompt?

Pokud stavíte produkty na API, ano, těchto sedm změn stojí za cílený audit promptů a úspory tokenů samy o sobě obvykle pokryjí vynaložené úsilí. Pokud GPT-5.6 používáte jen v chatu ChatGPT, platí stejné instinkty, zejména psát kratší seznamy pravidel a popisovat tón konkrétně. Co přesně získáte v bezplatné verzi, zjistíte v našem průvodci co zahrnuje bezplatný plán ChatGPT.

Pokud se vám zdá žonglování s modely, úrovněmi effort a ovladači verbosity příliš složité, aplikace jako Fello AI to směrování obstará za vás. Dává vám GPT-5.6 společně s Claude, Gemini, Grok a DeepSeek na jednom místě, takže každou úlohu pošlete silnému modelu bez jediného technického nastavení. Je to jednoduchý způsob, jak získat špičkové odpovědi a generovat obrázky, dokumenty a prezentace bez nutnosti znát celé API.

Závěr

Téma všech změn GPT-5.6 je totéž: říkejte méně a nechte model udělat více. Nejprve smažte opakující se pravidla, protože tento jediný krok zlepší kvalitu a sníží náklady. Pak přiřaďte každou úlohu ke správnému modelu a úrovni effort, přepište pravidla stručnosti a tónu a využijte verbosity a programmatic tool calling, abyste přestali opakovat stále totéž.

Začněte dnes svým nejdelším systémovým promptem, odstraňte každou zdvojenou instrukci a vyzkoušejte o jednu úroveň effort nižší než dosud. Toto jedno odpoledne úprav přinese s GPT-5.6 největší návratnost.

Často kladené otázky

Jak promptovat GPT-5.6?

Každou instrukci napište přesně jednou a smažte opakující se pravidla ze starých promptů. OpenAI zjistilo, že to zvýší skóre o 10 až 15 % a sníží počet tokenů až o 66 %. Vyberte správnou úroveň modelu, nastavte úroveň reasoning effort a tón popisujte konkrétním chováním místo neurčitých přídavných jmen.

Jaké jsou úrovně reasoning effort v GPT-5.6?

GPT-5.6 má šest úrovní: none, low, medium, high, xhigh a max. OpenAI doporučuje začít na úrovni, kterou jste používali u předchozího modelu, pak vyzkoušet o jednu nižší, protože GPT-5.6 obvykle potřebuje méně přemýšlení ke stejné odpovědi. Úroveň max si nechte pro nejtěžší problémy.

Má GPT-5.6 pro mode?

Ano. Nastavte reasoning.mode na pro v Responses API a GPT-5.6 před vrácením jediné závěrečné odpovědi věnuje požadavku extra výpočetní kapacitu. Funguje s jakoukoli úrovní effort a hodí se pro požadavky s vysokými nároky na správnost. To se liší od max effort, nejvyšší ze šesti úrovní, i od ultra mode v ChatGPT, který spouští subagenty.

Který model GPT-5.6 použít: Sol, Terra nebo Luna?

Použijte Sol ($5/$30 za 1M tokenů) pro nejtěžší problémy, Terra ($2/$12) pro každodenní firemní práci a Luna ($0.20/$1.20) pro levné úlohy s velkým objemem. OpenAI snížilo Terra o 20 % a Luna o 80 % dne 30. července 2026 a Sol ponechalo beze změny. OpenAI doporučuje začít se Sol, pak otestovat, zda Terra nebo Luna obstojí na vašich reálných úlohách, a tak ušetřit náklady.

Co je programmatic tool calling v GPT-5.6?

Programmatic tool calling umožňuje GPT-5.6 napsat malý program v JavaScriptu, který zpracuje výsledky nástrojů v izolovaném prostředí a vrátí pouze kompaktní výsledek. Velké datové sady neprocházejí modelem token po tokenu, takže datově náročné úlohy běží rychleji a výrazně levněji.