První zářijový týden roku 2026 přinesl neobvykle silnou vlnu nových AI modelů. OpenAI představilo GPT‑6 Astra, Anthropic Claude Fable 5.1, Meta Muse Spark 1.3, Google Gemini 3.8 Flash a institut IFM šest otevřených modelů K2 Horizon.
Během několika dnů se změnila nabídka nejsilnějších, rychlých i otevřených modelů. Každý výrobce zdůrazňuje jiné prvenství, ale pro firmu je užitečnější jednoduché rozdělení:
- GPT‑6 Astra míří na nejsložitější práci a ovládání počítače,
- Claude Fable 5.1 na dlouhé programování a znalostní práci,
- Muse Spark 1.3 na agenty a vývoj v ekosystému Meta,
- Gemini 3.8 Flash na rychlost, velký objem a agentické workflow,
- K2 Horizon na otevřenost, vlastní nasazení a výzkum.
Neznamená to, že firma musí pětkrát měnit technologii. Znamená to, že už nedává smysl automaticky posílat každý úkol jednomu modelu.
GPT-6 Astra: nejsilnější model OpenAI
Největší pozornost získala GPT‑6 Astra, kterou OpenAI představilo 3. září.
Firma ji označuje za svůj dosud nejschopnější široce nasazovaný model. Zaměřuje se na:
- ovládání počítače a prohlížeče,
- dlouhé programovací úlohy,
- vědeckou a odbornou práci,
- používání nástrojů,
- kyberbezpečnost,
- práci v několika navazujících krocích.
Astra je také první model OpenAI, který dosáhl úrovně Critical v oblasti kybernetických schopností podle Preparedness Frameworku. To znamená schopnost nacházet dosud neznámé bezpečnostní chyby a vytvářet způsoby jejich zneužití bez vedení člověkem krok za krokem.
Přístup se zavádí postupně. Po vybraných organizacích má model dorazit do placených plánů ChatGPT a API.
Cena API byla oznámena na 10 USD za milion vstupních a 50 USD za milion výstupních tokenů. Astra proto nebude rozumnou volbou pro každou rutinní činnost.
Podrobný rozbor najdete v článku GPT-6 Astra: co umí, kolik stojí a kdy bude dostupná v ChatGPT.
Claude Fable 5.1: dlouhé úlohy a znalostní práce
Anthropic představil Claude Fable 5.1 a omezenou variantu Claude Mythos 5.1.
Podle firmy jde o stejný základní model se dvěma úrovněmi ochrany. Fable je obecně dostupná varianta, zatímco Mythos je určený vybraným organizacím pro citlivější práci v kyberbezpečnosti a přírodních vědách.
Fable 5.1 cílí především na:
- dlouhé programovací úlohy,
- hledání příčin technických problémů,
- práci s rozsáhlými dokumenty,
- výzkum a odborné analýzy,
- agentické procesy trvající déle než několik minut.
Anthropic zároveň snížil cenu čtení z cache. To je důležité u agentů, kteří opakovaně pracují se stejným dlouhým zadáním, kódem nebo firemní dokumentací.
Pro firmu může být Fable zajímavá tam, kde model čte velký základní kontext opakovaně. Nejde jen o cenu samotného výstupu, ale o celou spotřebu během dlouhé úlohy.
Meta Muse Spark 1.3: Meta dohání špičku
Meta vydala Muse Spark 1.3 s lepším výkonem v programování a agentických úlohách.
Model má být praktičtější při dlouhé práci s nástroji a efektivnější než předchozí verze. Meta jej zpřístupňuje vývojářům přes vlastní modelové API a rozvíjí také nástroje pro programování.
Důležité je, že Meta nesází pouze na chat v sociálních sítích. Buduje model, který má zvládat skutečnou práci:
- plánování více kroků,
- používání nástrojů,
- programování,
- zásahy uživatele během delší úlohy,
- potvrzení před nevratnými akcemi.
Nejvyšší režim uvažování má přijít později po dokončení bezpečnostních testů. Meta také nadále mluví o budoucím otevření vah některé z verzí, ale u aktuálního modelu je potřeba rozlišovat mezi příslibem a skutečně dostupným vydáním.
Gemini 3.8 Flash: rychlý model pro velký objem
Google uvedl Gemini 3.8 Flash a zvláštní bezpečnostní variantu Gemini 3.8 Flash Cyber.
Flash není zamýšlený jako nejdražší model na každou úlohu. Jeho role je jiná: nabídnout vysoký výkon při nižší ceně a rychlé odezvě.
Google jej zaměřuje na:
- programování,
- agentické znalostní workflow,
- práci s dlouhým kontextem,
- volání funkcí a nástrojů,
- vyhledávání a práci se soubory,
- velký objem požadavků.
Model podporuje kontext přes jeden milion tokenů, práci s nástroji a v náhledu také ovládání počítače.
Varianta Flash Cyber je určená pro vybrané instituce, správce kritické infrastruktury a bezpečnostní týmy. Podobně jako u Astry se ukazuje, že nejsilnější kybernetické schopnosti nebudou automaticky dostupné každému uživateli bez omezení.
Pro běžnou firmu může být standardní Flash zajímavější než Cyber. Hodí se na velké množství úloh, kde je důležitá rychlost a cena, ale jednoduchý levný model už nestačí.
K2 Horizon: šest plně otevřených modelů
Institute of Foundation Models při MBZUAI představil rodinu K2 Horizon.
Jde o šest modelů od 0,9 miliardy do 375 miliard parametrů:
- 0,9B,
- 3,7B,
- 7B,
- 32B,
- 36B‑A4B,
- 375B‑A23B.
Největší rozdíl oproti uzavřeným modelům OpenAI, Anthropic, Googlu a Meta není jen ve výkonu. IFM zveřejňuje váhy, kód, trénovací data a metodiku.
To umožňuje model:
- stáhnout a provozovat na vlastní infrastruktuře,
- upravit pro konkrétní použití,
- zkontrolovat jeho vznik a trénovací postup,
- reprodukovat část výzkumu,
- nasadit i bez odesílání dat jednomu cloudovému poskytovateli.
Menší modely mají smysl pro zařízení a úzké lokální úlohy. Největší směs expertních modelů míří na datová centra, výzkum a pokročilé firemní nasazení.
Otevřený model ale není automaticky levný. Firma musí zaplatit hardware, provoz, aktualizace, zabezpečení a lidi, kteří systému rozumějí.
Rychlé srovnání
| Model | Hlavní přednost | Typické použití | Hlavní omezení |
|---|---|---|---|
| GPT-6 Astra | nejsložitější agentické úlohy a práce s počítačem | vývoj, odborná práce, kontrola náročných procesů | vysoká cena a postupné zpřístupnění |
| Claude Fable 5.1 | dlouhé programování a dokumenty | vývoj, výzkum, znalostní práce | závislost na uzavřené službě |
| Muse Spark 1.3 | agenti a programování v ekosystému Meta | vývojářské nástroje a vícekroková práce | část režimů a otevřených vah teprve přijde |
| Gemini 3.8 Flash | rychlost, dlouhý kontext a cena | velký objem, nástroje, automatizace | ne vždy nahradí nejvyšší model u kritické práce |
| K2 Horizon | úplná otevřenost a vlastní provoz | self-hosting, výzkum, citlivá data | náklady a odpovědnost za vlastní infrastrukturu |
Který model má vybrat běžná firma
Pro každodenní práci
Začněte u modelu, který už používáte, a měňte pouze tehdy, když znáte konkrétní problém. Může jít o cenu, pomalost, chyby, omezený kontext nebo špatnou práci s nástroji.
Pro složitý vývoj
Otestujte Astru a Fable na stejném skutečném projektu. Nestačí porovnat jednorázové vygenerování funkce. Sledujte, zda model chápe celý projekt, spouští testy a opraví vlastní chybu.
Pro velký objem
Gemini Flash nebo jiný levnější rychlý model může být vhodnější než Astra. U tisíců požadavků denně se rozdíl v ceně násobí.
Pro citlivá data a vlastní provoz
K2 Horizon a další otevřené modely dávají větší kontrolu. Neznamená to ale, že se nainstalují jedním kliknutím a dál se o ně nikdo nestará.
Pro automatizace s více kroky
Nesázejte na jeden model. Levný model může třídit a připravovat data, střední model řešit běžnou práci a nejsilnější model kontrolovat pouze výjimky.
Co se skutečně změnilo
Tato vlna modelů ukazuje tři důležité směry.
1. AI už není jen chat
Všichni velcí výrobci zdůrazňují agenty, nástroje, programování a ovládání počítače. Hodnota se přesouvá od hezké odpovědi k dokončené práci.
2. Bezpečnost se dělí podle přístupu
Astra, Mythos i Gemini Flash Cyber ukazují, že část pokročilých schopností bude dostupná jen ověřeným organizacím. Model může mít stejný základ, ale jiná oprávnění a ochranné vrstvy.
3. Jeden model na všechno zdražuje provoz
Rozdíly v ceně jsou příliš velké. Pouštět nejdražší model na jednoduché třídění nedává smysl. Stejně tak není rozumné nechat levný model rozhodovat o drahé nebo citlivé věci jen kvůli úspoře několika korun.
Co by měla firma udělat tento měsíc
- Vybrat deset skutečných úloh, kde už používá AI.
- Rozdělit je na rutinní, běžné a kritické.
- Porovnat dva až tři modely na stejném zadání a datech.
- Měřit cenu dokončeného výsledku, ne cenu jedné odpovědi.
- Zkontrolovat oprávnění agentů a schvalování rizikových akcí.
- U citlivých dat zvážit vlastní nebo oddělené prostředí.
- Neměnit fungující systém pouze podle firemního benchmarku.
Verdikt
GPT‑6 Astra je největší novinkou týdne, ale není jedinou důležitou změnou.
Claude Fable 5.1 posiluje dlouhou odbornou práci. Meta se s Muse Spark přibližuje čelu agentických modelů. Gemini Flash tlačí na rychlost a cenu. K2 Horizon nabízí mimořádnou míru otevřenosti.
Vítězem proto nemusí být jeden model. Pro firmu vyhraje kombinace, která dokončí práci spolehlivě, za rozumnou cenu a s jasnou kontrolou.
Jak pomáhá Kodo
V Kodo vybíráme model podle konkrétního firemního procesu. Porovnáme cloudové i otevřené varianty, změříme náklady a nastavíme, co může běžet samo a co musí potvrdit člověk.
Související články
- GPT-5.6 Sol, Terra a Luna: který model vybrat a kolik stojí
- OpenAI Astra a bezpečné nasazení AI agentů
- Kdy firmě nestačí běžný ChatGPT a dává smysl vlastní AI server
Zdroje
- OpenAI: GPT-6 Astra, 3. 9. 2026
- Anthropic: Claude Fable 5.1 a Mythos 5.1, 1. 9. 2026
- Meta: Muse Spark 1.3, 2. 9. 2026
- Google: Gemini 3.8 Flash a Flash Cyber, 2. 9. 2026
- IFM: K2 Horizon, 3. 9. 2026
