Najpodstatnejšia pointa GPT-5.6 je, že výkon modelu sa čoraz viac meria cez dokončenú prácu, nie cez jednu odpoveď. OpenAI hovorí o silnejšom výkone na dolár, menšom počte tokenov a lepšom zvládaní viacstupňových úloh.
Sol, Terra a Luna riešia rôzne úrovne náročnosti
Vlajkový model Sol je určený na najťažšie úlohy, kde záleží na maximálnej inteligencii, komplexnom plánovaní, kódovaní, vedeckom výskume a práci s viacerými krokmi. Terra slúži ako vyvážená voľba pre každodenné pracovné scenáre – písanie, analýzu dokumentov, brainstorming a bežné kódovanie. Podľa OpenAI ponúka podobný výkon ako GPT-5.5 približne za polovičnú cenu. Luna je najrýchlejší a cenovo najefektívnejší model vhodný na rýchle konverzácie, sumarizácie a rutinné úlohy.
Takáto architektúra dáva zmysel, pretože firemné workflow nemá jednotnú náročnosť. Niektoré úlohy vyžadujú hlbokú analýzu, porovnávanie zdrojov alebo tvorbu komplexných artefaktov. Iné sú rutinné, napríklad triedenie, sumarizácia, kontrola jednoduchých vstupov alebo generovanie štandardizovaných výstupov.
Pre marketingové a technologické tímy je to prakticky dôležité pri automatizácii. Nie každá časť procesu potrebuje najsilnejší model. Strategická analýza kampane, tvorba pitch decku alebo syntéza dát z viacerých zdrojov môže vyžadovať Sol. Na opakované spracovanie jednoduchších podkladov môže stačiť efektívnejší model. Práve tento výber môže rozhodovať o tom, či bude AI workflow ekonomicky udržateľné.
Programové volanie nástrojov ako dôležitý posun
Jednou z technicky dôležitých noviniek je Programmatic Tool Calling. V jednoduchosti ide o spôsob, ako model efektívnejšie pracuje s nástrojmi a štruktúrovanými API. Pri agentických úlohách totiž model často nepotrebuje iba odpovedať používateľovi, ale volať funkcie, čítať dáta, vykonať krok v systéme a pokračovať podľa výsledku.
Programmatic Tool Calling umožňuje modelu napísať a spustiť ľahký program v pamäti, ktorý koordinuje volania nástrojov, spracúva medzivýsledky a určuje ďalšie kroky. Nemusíme pre každý nový scenár ručne navrhovať vlastnú logiku volania nástrojov, čo šetrí prácu najmä v prostrediach s väčším počtom nástrojov a zložitejšími cestami volaní.
OpenAI uvádza, že GPT-5.6 dosahuje výrazne nižšiu spotrebu tokenov a menej modelových krokov pri rôznych úlohách. Napríklad v agentickom programovaní Sol oproti porovnateľným modelom znižuje počet výstupných tokenov o 54 %, skracuje čas potrebný na dokončenie úlohy o viac ako polovicu a znižuje náklady približne o tretinu.
Ak model lepšie komunikuje s nástrojmi, môže spoľahlivejšie generovať tabuľky, upravovať dokumenty, pracovať s dizajnovými nástrojmi, vytvárať webové artefakty alebo koordinovať úlohy cez firemné systémy. V agentickej AI je kvalita práce s nástrojmi rovnako dôležitá ako kvalita textu.
Nové režimy: max a ultra
GPT-5.6 prináša dva nové režimy nastavenia. Max dáva modelu viac času na premýšľanie, kontrolu a revíziu vlastného postupu pred odpoveďou. Ultra koordinuje paralelnú prácu viacerých agentov na komplexných úlohách – podobne ako rozdelenie projektu medzi členov tímu.
Užívatelia si môžu zvoliť, či chcú rýchlu odpoveď, alebo sú ochotní počkať na dôkladnejšie spracovanie zložitejšej úlohy. V praxi to otvára možnosti pre náročnejšie projekty, kde záleží na kvalite výsledku viac než na rýchlosti.
Výkon v praxi: efektivita a agentická práca
Nezávislé benchmarky potvrdzujú, že GPT-5.6 prináša výrazné zlepšenia v pomere výkonu k nákladom. V Artificial Analysis Intelligence Index sa GPT-5.6 Sol (max) umiestnil tesne za Claude Fable 5, no pri približne tretinových nákladoch na úlohu. V Coding Agent Index dokonca GPT-5.6 Sol (max) v prostredí Codex vedie so skóre 80 bodov, pričom náklady na úlohu sú o približne 40 % nižšie než u Claude Fable 5.
GPT-5.6 je prvým modelom, ktorý vyhral verejnú hru v benchmarku ARC-AGI-3. Sol pri maximálnom úsilí dosiahol na tomto benchmarku 7,8 %, čo síce nie je vysoké číslo, ale ide o prvý model schopný správne sa zorientovať v novom prostredí a plánovať ďalšie kroky na základe neúspešných hypotéz. To naznačuje posun v schopnosti modelov pracovať v neznámych situáciách. GPT-5.6 prináša aj nový spôsob ceny za prompt caching – ukladanie vstupov do vyrovnávacej pamäte sa spoplatňuje 1,25-násobkom ceny za vstup, zatiaľ čo čítanie z cache zostáva zvýhodnené 90 % zľavou. Táto zmena presnejšie odráža reálne náklady na poskytovanie modelov.
Bezpečnosť a rozšírenie
GPT-5.6 vychádza s doteraz najrobustnejšími bezpečnostnými opatreniami . OpenAI strávila týždne hľadaním slabín a záťažovým testovaním systémov . Na automatizované red-teaming (hľadanie chýb a bezpečnostných dier) použila viac než 700 000 A100 ekvivalentných GPU hodín .
Model je podľa OpenAI výrazne lepší v identifikácii softvérových zraniteľností, no zároveň neprekračuje kritický prah v oblasti kybernetickej bezpečnosti podľa ich vlastného rámca pripravenosti . To znamená, že hoci je model v tejto oblasti schopnejší, jeho schopnosti sú stále pod úrovňou, ktorú OpenAI považuje za kriticky nebezpečnú.
GPT-5.6 sa zavádza postupne počas 24 hodín od 9. júla na platformách ChatGPT, Codex a OpenAI API . Prístup k jednotlivým modelom a režimom sa líši podľa predplatiteľského tieru .
GPT-5.6 je model pre pracovné agentické workflow
GPT-5.6 je dôležitý preto, že spája vyššiu inteligenciu, lepšiu efektivitu a dôraz na prácu s nástrojmi. Pre používateľov sa to môže prejaviť menej nápadne než nová aplikácia, ale pre kvalitu agentickej AI je práve modelová vrstva rozhodujúca. OpenAI tým signalizuje, že budúcnosť AI nasadenia nebude o jednom univerzálnom nastavení – bude viac pripomínať architektúru, kde sa silnejšie modely používajú na náročné rozhodovanie a lacnejšie modely na opakované úlohy.



