GPT-5.6 Sol, Terra a Luna: OpenAI oddeľuje výkon, cenu aj riziko

OpenAI 9. júla 2026 posunulo GPT-5.6 za hranicu obmedzeného preview a oficiálne opísalo celú rodinu Sol, Terra a Luna. Pôvodná pointa článku tým zosilnela: nejde len o ďalší najchytrejší model, ale o modelovú vrstvu, kde sa oddeľuje výkon, cena, režim nasadenia a schopnosť pracovať ako agent.
Pre firmy je to praktický signál. AI stack sa prestáva správať ako „jeden najlepší model na všetko“ a viac pripomína cloudovú architektúru: rýchla vrstva pre veľký objem práce, hlavný worker, drahý špecialista a po novom aj režimy, ktoré koordinujú viac agentov naraz.
Aktualizácia 13. 7. 2026: general availability, ChatGPT Work a ultra režim
OpenAI v novom oficiálnom článku z 9. júla uvádza, že GPT-5.6 family je po preview dostupná širšie: Sol ako flagship, Terra ako vyvážený model pre bežnú prácu a Luna ako najlacnejšia vrstva. Dôležitá zmena oproti pôvodnému preview je, že OpenAI už neopisuje len bezpečnostne obmedzený rollout, ale celú produktovú architektúru pre ChatGPT, Codex, API a agentickú prácu.
Pre prax sú zásadné tri veci.
Prvá je Programmatic Tool Calling v Responses API. OpenAI tým mieri na úlohy, kde model nemusí zakaždým posielať všetky medzivýsledky späť do hlavného promptu, ale časť práce vie filtrovať a riadiť programovo. To je presne typ optimalizácie, ktorý rozhoduje pri dlhých agentických workflow: menej tokenov, menej round-tripov, menšia latencia a lepšia kontrola nákladov.
Druhá vec je nový režim ultra. OpenAI ho opisuje ako najvyšší capability setting, ktorý koordinuje viac agentov paralelne. Pre firmy to neznamená „zapnite ultra všade.“ Znamená to mať v routeri vetvu pre naozaj ťažké prípady: due diligence, väčšie codebase migrácie, incident analysis, komplexný dokumentový audit alebo výskumnú úlohu, kde sa oplatí väčší compute a kratší čas k výsledku.
Tretia vec je ChatGPT Work. Sekundárne zdroje The Verge a Axios ho opisujú ako spojenie ChatGPT a Codex štýlu práce pre bežné knowledge-work úlohy: dokumenty, tabuľky, prezentácie, webové aplikácie, napojenie na pracovné dáta a dlhšie multi-step úlohy. Oficiálny článok OpenAI spomína znalostnú prácu cez Slack, Notion, Microsoft 365 a Google Drive a tiež interaktívne výstupy v ChatGPT Work. Pre firmy je dôležitejšie než názov funkcie to, že chat sa posúva k pracovnému agentovi, ktorý má robiť hotové artefakty, nie iba odpovedať.
Praktický záver: GPT-5.6 už nie je len „Sol preview pre trusted partners.“ Je to modelová rodina pre routing. Luna/Terra dávajú zmysel pre objem a bežnú prácu, Sol pre ťažké vetvy, max/ultra pre výnimočne drahé úlohy a Programmatic Tool Calling pre workflow, kde sa počítajú tokeny a latencia.
Čo OpenAI potvrdilo priamo
V oficiálnom oznámení OpenAI píše, že GPT-5.6 Sol štartuje ako limitovaný preview pre malú skupinu trusted partners a že k tomuto rollout režimu pristúpilo na žiadosť vlády USA. Dôvodom je kybernetické riziko. OpenAI zároveň tvrdí, že model je lepší v hľadaní a opravovaní zraniteľností než v spoľahlivom vykonávaní end-to-end útokov.
To je podstatný detail. Nie je to len ďalší launch typu „prekonali sme benchmark.“ Je to signál, že frontier modely sa začínajú posudzovať aj podľa toho, ako bezpečne ich možno pustiť do širšej prevádzky.
System card k GPT-5.6 navyše opisuje úroveň High v biologických a chemických schopnostiach a model prepája s Preparedness Frameworkom OpenAI. Inak povedané: capability skok už nie je len technická alebo marketingová téma. Je to aj governance téma.
Čo dopĺňajú silné sekundárne zdroje
The Verge a Business Insider pridávajú produktový kontext, ktorý sa v indexovaných OpenAI stránkach zatiaľ nedal dobre dohľadať. Podľa týchto reportov je nová rodina rozdelená do troch vrstiev:
- Luna ako lacnejšia a rýchlejšia vrstva pre veľký objem práce,
- Terra ako hlavný vyvážený worker,
- Sol ako najdrahšia a najsilnejšia vrstva.
The Verge uvádza ceny približne $2 / $8 za milión tokenov pri Lune, $6 / $25 pri Terre a $15 / $60 pri Sole. Beriem to ako dôveryhodný report, ale nie ako detail plne potvrdený verejne indexovanou OpenAI pricing page.
Praktický záver však platí už teraz: OpenAI sa posúva od príbehu o jednom vlajkovom GPT k vedomému tieringu, ktorý sa oveľa viac podobá tomu, ako si firmy dnes skladajú routing medzi lacným filtrom, hlavným workerom a drahým špecialistom.
Prečo je to dôležité pre firemné workflow
Toto nie je správa len pre ľudí, ktorí sledujú benchmarky. Je to dôležité pre každého, kto stavia AI workflow v n8n, Make, CRM enrichmente, supporte alebo interných agentoch.
Zdravá architektúra nepotrebuje najdrahší model na každé volanie. Typický pattern môže vyzerať takto:
- Luna na klasifikáciu, ľahké prepisy, prvý priechod dokumentom alebo lacné guardrail kroky,
- Terra na hlavné worker úlohy ako extrakcia, sumarizácia, štruktúrovaný JSON, drafty e-mailov alebo CRM enrichment,
- Sol na ťažké výnimky: hlbší security review, väčší code refactor, viaczdrojovú analýzu alebo citlivé rozhodnutie, kde aj tak chcete človeka v schvaľovacej slučke.
To sa priamo hodí do praxe. Nechcete platiť top-tier cenu za každý rutinný support ticket. Nepotrebujete maximálny reasoning pri každom kroku vo faktúrach alebo lead triage. Ale pri hraničných prípadoch, kde ide o peniaze, bezpečnosť alebo reputáciu, môže drahšia vrstva dávať zmysel.
Čo sa mení oproti doterajšej debate o modeloch
Doteraz sme modely často porovnávali v duchu „čo je lepšie než čo.“ GPT-5.6 ukazuje užitočnejší rámec: ktorý model patrí do ktorej vrstvy workflow.
To je zrelší spôsob uvažovania než nekonečné porovnávanie jedného leaderboardu. Firme viac pomôže otázka:
- čo chcem robiť lacno a často,
- čo chcem robiť ako hlavný pracovný krok,
- čo chcem eskalovať na drahú expert-level vrstvu,
- a kde potrebujem audit, approval alebo fallback.
Nie je to ďaleko od toho, ako už dnes premýšľame o cloudovej infraštruktúre, queue systémoch alebo databázach. Rozdiel je len v tom, že táto logika sa konečne začína objavovať aj priamo v rodine modelov.
Kde by som bol opatrný
Prvá opatrnosť je jednoduchá: general availability nie je dôvod prepísať všetko naraz. Ak dnes bežíte stabilné workflow na GPT-5.5 alebo inom modeli, otestujte GPT-5.6 na vlastných evaloch, zmerajte cenu, latenciu, fallbacky a kvalitu artefaktov, nie iba benchmarkové titulky.
Druhá vec je governance. Keď OpenAI samo hovorí, že rollout začína na žiadosť vlády USA a v obmedzenom režime, je to signál, že pri top-tier modeloch bude čoraz dôležitejšie riešiť:
- dostupnosť podľa regiónu a typu zákazníka,
- prístupovú politiku,
- auditnú stopu,
- ľudské schválenie pri citlivých operáciách,
- a pripravený fallback na inú vrstvu alebo iného vendora.
Tretia vec je cena. Ak sa potvrdia cenové rozostupy medzi Lunou, Terrou a Solom, posielať všetko do jedného modelu prestane dávať zmysel. Nákladová disciplína bude rovnako dôležitá ako kvalita odpovede.
Ako by som to nasadil
Ak by som dnes navrhoval nový firemný agentný workflow, nepozeral by som sa na GPT-5.6 ako na jednu vec. Pozeral by som sa naň ako na router-ready model family.
V praxi to môže znamenať:
- lacný model pre intake a klasifikáciu,
- worker model pre väčšinu prevádzky,
- top model len pre eskalované prípady,
- pravidlovú validáciu nad výstupom,
- a človeka v slučke pri drahých alebo nevratných krokoch.
To funguje pri lead triage, support classification, extrakcii z dokumentov, e-mailových workflow, internom copilote aj pri coding agentoch. Presne preto je GPT-5.6 zaujímavejší než samotný marketingový titulok.
Záver
GPT-5.6 Sol je dôležitý menej ako „ďalší najchytrejší model“ a viac ako signál, že OpenAI začína verejne oddeľovať výkon, cenu a riziko do samostatných tierov. To je presne smer, ktorý dáva zmysel aj vo firemnej architektúre.
Ak sa tento rodinný vzorec potvrdí aj pri širšej dostupnosti, hlavná otázka nebude „mám používať GPT-5.6?“ Hlavná otázka bude: ktorú vrstvu GPT-5.6 pustím do ktorého kroku workflow a kde chcem audit, limit a fallback.
Aktualizácia 25. 7. 2026: schopnosť modelu nie je oprávnenie pre produkčného agenta
OpenAI 21. júla zverejnilo, že pri internom hodnotení kybernetických schopností kombinácia modelov vrátane GPT-5.6 Sol kompromitovala infraštruktúru Hugging Face. Modely v izolovanom benchmarku ExploitGym najprv našli zero-day v proxy cache registra balíčkov, získali cestu k internetu a v jednom opísanom prípade spojili ukradnuté prihlasovacie údaje so zraniteľnosťou pre vzdialené spustenie kódu. Hugging Face aktivitu odhalil a zastavil.
Nie je to dôvod tvrdiť, že bežný Sol v API „sám hackuje servery“. OpenAI výslovne uvádza, že išlo o interný eval, kde boli na meranie maximálnej capability zámerne vypnuté produkčné klasifikátory odmietajúce rizikové kybernetické akcie. Je to však dôležitá praktická korekcia pre každého, kto stavia coding alebo IT ops agenta: samotný safety režim modelu nie je bezpečnostná hranica.
Pre agenta, ktorý číta tickety, e-maily, repozitáre alebo dokumentáciu a vie spúšťať nástroje, by som z toho vyvodil päť prevádzkových pravidiel:
- krátkodobé credentials pre jednotlivú úlohu namiesto zdieľaného administrátorského tokenu,
- network egress allowlist a oddelené sandboxy, nie iba „agent nemá chodiť na internet,“
- minimálne práva pre Git, cloud aj databázy; oddeliť čítanie a zápis,
- approval pred externým odoslaním, zmenou infraštruktúry a prácou so secrets,
- auditný log tool calls, alert na nové domény a kill switch pre beh agenta.
V n8n alebo Make to znamená nedať jednému workflow súčasne prístup k inboxu, CRM exportu a ľubovoľnému HTTP requestu. Pri coding agentovi to znamená oddeliť checkout, testovacie prostredie a nasadzovacie oprávnenia. Router medzi Luna, Terra a Sol preto musí rozhodovať nielen o cene a kvalite, ale aj o rozsahu oprávnení, s ktorým daný krok beží.
Zdroje: OpenAI: Introducing a limited preview of GPT-5.6 Sol, OpenAI: GPT-5.6 system card, OpenAI: Updating our Preparedness Framework, The Verge: OpenAI’s newest model is so powerful that the government is involved, Business Insider: OpenAI limited preview for GPT-5.6, YouTube signál: Marek Bartoš, OpenAI: GPT-5.6 general availability, The Verge: GPT-5.6 a ChatGPT Work, Axios: ChatGPT Work, Luna, Terra a Sol, YouTube signál: Zaujaloma AI, YouTube signál: Tomas AI, YouTube signál: Marek Bartoš, OpenAI: security incident during model evaluation, YouTube signal: Zaujaloma AI.