Fable 5 v Maxu vs. GPT‑5.6 Sol v ChatGPT Work a Codexu: porovnávejte limity, ne API ceníky

Srovnávat Fable 5 v Claude Maxu s API cenou GPT‑5.6 Sol nebo Kimi K3 je špatná otázka. V jednom případě kupujete osobní pracovní kapacitu v předplatném, v druhém měříte provoz agentů po tokenech. Obojí je užitečné, ale řeší jiné rozhodnutí.
Správné srovnání je toto: Fable 5 v Maxu vs. GPT‑5.6 Sol v ChatGPT Work a Codexu. Jsou to dvě cesty, jak pustit silný model do každodenní práce bez toho, aby každý úkol začínal API fakturou. Kimi K3 je třetí větev: dnes má vlastní členství i API, a jako otevřený model míří k self-hostingu. Gemini 3.5 Pro zatím zůstává watchlistem.
Dvě předplatná, dva typy limitu
E-mail Anthropicu uvádí, že Fable 5 je v mém Max plánu standardně zahrnutý až do poloviny týdenního limitu; po vyčerpání lze pokračovat přes usage credits a Fable čerpá kapacitu rychleji než jiné modely. To je konkrétní a srozumitelný „budget“: Fable nepatří na každé drobné zadání, ale na práci, kde ušetří nejvíc lidského času.
OpenAI naopak uvádí GPT‑5.6 Sol pro placené plány v ChatGPT, ChatGPT Work a Codexu. Work používá stejnou usage strukturu jako Codex; Codex má tokenový rate card, sdílené limity s dalšími agentními funkcemi a možnost dokupovat credits podle plánu. OpenAI veřejně nedává jednu univerzální větu typu „polovina týdenního limitu pro Sol,“ protože skutečná spotřeba závisí na plánu, effortu, délce agentní úlohy a použitých nástrojích.
| Vrstva | Fable 5 v Claude Max | GPT‑5.6 Sol v ChatGPT Work / Codex | Co to znamená v praxi |
|---|---|---|---|
| Model v předplatném | Fable 5 jako prémiová kapacita | Sol, Terra a Luna podle placeného plánu a model pickeru | obojí je pracovní nástroj, ne API endpoint pro dávku 50 000 položek |
| Limit | podle doručeného e-mailu až 50 % týdenního Max limitu pro Fable | Work sdílí usage strukturu Codexu; limity a credit rate závisí na plánu a úloze | nelze převést na férové „kolik Fable = kolik Sol“ bez vlastního usage exportu |
| Po vyčerpání | usage credits | credits / flexibilní tokenový rate card podle plánu | nastavte strop a upozornění dřív, než začnete delegovat dlouhé agenty |
| Nejlepší role | těžký coding, research, rozhodovací memo, review | Work pro artefakty a výzkum; Codex pro repozitář, testy, příkazy a review | vybírejte podle pracovního prostředí, ne jen benchmarku |
Jak bych rozdělil práci mezi Fable a Sol
Fable v Maxu bych nechal na úlohy, kde je cenné zůstat v dlouhé argumentaci: návrh větší změny, incident review, research memo s nejistotami, revize dokumentu před odesláním nebo složitý refactor, který má nejdřív vysvětlit plán.
GPT‑5.6 Sol v Worku bych použil tam, kde chci výsledný artefakt nad týmovým kontextem: tabulku, briefing, plán, analýzu nebo dashboard. V Codexu dává Sol smysl pro technickou práci, která vyžaduje běh testů, procházení repozitáře a kontrolu diffu. max effort není automaticky lepší nastavení – patří na pár nejtěžších úkolů, protože spotřebuje více kapacity.
Praktické pravidlo pro jednoho člověka: když mám v týdnu jeden opravdu důležitý nejasný problém, nespálím Fable ani Sol na deset běžných e-mailů. Nejprve levnější model nebo rychlý chat; prémiovou kapacitu až pro úlohu s jasným cílem, vstupy, kritérii hotovo a lidským review na konci.
Kimi K3 není „levnější Fable v API“
Kimi K3 je relevantní proto, že nabízí tři různé provozní režimy:
- Kimi membership / Kimi Code pro osobní práci s kredity a limity.
- API pro vlastní agentní workflow, včetně 1M kontextu, tool calls a structured outputs.
- Open weights / self-hosting jako strategická možnost pro tým, který chce mít inference pod vlastní kontrolou.
Třetí bod je důležitý, ale nesmí se zkrátit na „open model, tedy hned ho nasadíme doma.“ Kimi K3 se prezentuje jako open 3T-class model a Kimi Code jej označuje za open-sourced. Současně detailní oznámení Kimi říká, že plné váhy budou vydané do 27. července 2026. K 21. červenci tedy self-hosting beru jako připravený směr a eval projekt, ne jako potvrzenou hotovou produkční instalaci.
Až váhy budou venku, cena K3 nebude $3 / $15 za milion tokenů – to je API ceník. Self-hosting bude znamenat kapacitu GPU, serving stack, cache, observabilitu, aktualizace, bezpečnostní izolaci, fronty a on-call. Smysl dává pro stabilní velký objem, citlivou data residency nebo tým, který už tuto platformu umí provozovat. Pro pět nepravidelných úloh týdně bude API téměř jistě rozumnější.
Gemini 3.5 Pro: čekat na konkrétní produkt, ne na marketingovou kolonku
Google na I/O uvedl Gemini 3.5 Pro jako interně používaný model s plánovaným rolloutem. Dokud nejsou veřejně potvrzené model ID, limity, cena a podmínky pro Work/API, nemá smysl jej zařazovat do srovnávací tabulky limitů. Do backlogu ano; do produktového rozhodnutí ne.
Rozhodnutí, které bych udělal dnes
- Máte Claude Max a děláte těžké znalostní nebo coding úkoly? Vyhraďte Fable pro několik nejdražších problémů týdně.
- Už pracujete v ChatGPT Work nebo Codexu? Měřte Sol podle skutečné credit consumption a hotových artefaktů, ne podle API ceny.
- Potřebujete vlastní agentní backend nebo dlouhý kontext? Ověřte Kimi K3 přes API dnes; self-hosting plánujte až s dostupnými vahami a TCO infrastruktury.
- Potřebujete jednu univerzální volbu? Žádná není. Tým potřebuje limit, router a lidské schválení – ne další slepý default.
Zdroje: Anthropic Claude Fable, Max usage limits a usage credits; OpenAI GPT‑5.6 availability, ChatGPT Work a Codex a Codex rate card; Kimi K3 launch a stav vah a Kimi Code release notes; Google I/O 2026 a Gemini 3.5 Pro. Informace o 50% Fable kapacity vychází z e-mailu Anthropicu doručeného autorovi 21. 7. 2026.