Strategické rozbory, srovnání a retrospektivy jazykových modelů z reálného použití —
ne jen benchmarky, ale zkušenosti z produkčních projektů.
← Přehled všech modelů
OpenAI vydala 3. září GPT-6 Astra a její prezident Greg Brockman příchod modelu spojil s nástupem éry umělé obecné inteligence. Astra ukazuje podstatný posun v samostatné práci s počítačem. Nepotřebujeme ale pro tvrzení o AGI poněkud více?
Za stejný výsledek jako GPT-5.6 Sol nebo Grok 4.6 zaplatíte u nového modelu Mety zhruba o čtyřicet procent méně ve stejné kvalitě. Potvrzuje to nezávislé měření. Bude to stačit na návrat společnosti Meta do první AI ligy?
Milionový kontext, váhy volně ke stažení a stojí patnáct centů za milion vstupních tokenů. Zní to podezřele levně. Z.ai celý týden ten model obsluhovala na domácích čínských čipech a tvrdí, že cena za token jí vyšla srovnatelně s běžnými kartami od Nvidie. A to nikdo jiný nemá!
Gemini 3.7 Flash má být dosud nejchytřejší pracovní model na programování a agenty od Google. Jenže na vlajkovou loď se stále čeká a to vzbuzuje nervozitu. Jaký je model 3.7 Flash?
Nový GLM-5.3 otevřela kapitolu, na kterou obor nebyl připravený. Model poráží v hledání zranitelností všechno ostatní na trhu, včetně uzavřené špičky. Váhy mají vyjít za dva týdny, až firma dokončí bezpečnostní vyhodnocení. Takže?
Nový Grok 4.6 přichází měsíc po předchozí verzi a hned se pasuje na konkurenta oblíbeného modelu OpenAI Sol 5.6. Stojí však o třetinu méně. Čísla, zkušenosti, určení?
Meta vydala Muse Glimmer, model o 30 miliardách parametrů s otevřenými vahami pod Apache 2.0, který běží na jedné spotřebitelské grafické kartě. Měsíc po tom, co poprvé v historii vlastní model zpoplatnila. V agentní práci vede nad konkurencí své velikosti, v jednom čísle ale zaostává právě tam, kde model prodává.
Alibaba představila Qwen3.8-Max jako rovnocenného soupeře Fable 5 i GPT-5.6 Sol. Nezávislé měření Artificial Analysis mu ale dalo 53 bodů, tedy přesně tolik co Sonnetu 5. Zajímavější než ten rozdíl je otázka, jestli index měří to, na co Alibaba mířila.
Nový model Opus 5 je nejchytřejší, ale jen o bod. A ano, je levnější, než Fable 5, ale také dražší, než podobně chytří konkurenti včetně Kimi K3 s otevřenými vahami. Top modely se vyrovnávají schopnostmi, liší cenou a příjemností práce...
Google vydal tři modely třídy Flash – pracovní 3.6 Flash, úsporný 3.5 Flash-Lite a kyberbezpečnostní Flash Cyber. Nezávislé měření ale ukazuje, že chytrost 3.6 Flash zůstala na místě; posun je jen v efektivitě a ceně. Hlavní zpráva je chybějící vlajková loď – slíbený Gemini 3.5 Pro se dál zpožďuje.
Nejnovější model čínského Moonshot AI Kimi K3 je silnější, než Opus 4.8 a těsně dohání modely jako Fable nebo Sol. Už také ale přestává být "levným čínským modelem". Situace se dramaticky mění. Jde o "druhý deepseek moment" v AI?
Grok ve verzi 4.5 je silný kódovací model. Jak by ne, naučil se na datech uživatelů Cursoru a i když je prostor ke zlepšení, dotahuje se na dohled Opusu za zlomek ceny. Jaké jsou jeho silné a slabé stránky?
Čínský Tencent právě představil svou finální verzi modelu Hy3 pod svobodnou licencí. A to není málo. Marketing má model skvělý, výsledky už tak skvělé nejsou, ale jak říkají na Moravě: Dá sa pražákovi...
Nový čínský model má otevřené váhy a bilion natrénovaných parametrů, takže konkuruje nejlepším americkým modelům. Prý je také kompletně natrénovaný na čínských čipech. Opravdu? To by totiž bylo velké!
Claude Sonnet 5 zužuje rozdíl vůči Opus 4.8 za zlomek ceny a je dostupný hned na všech plánech. Po měsíci frontier dramat je to nejpraktičtější vydání. Pozor jen na nový tokenizer, který opticky snižuje cenu víc, než odpovídá realitě.
GLM-5.2 opravdu dotahuje Opus v některých disciplínách. Kolem té skutečnosti ale vyrostla vlna textů, které ji nafukují drobným ohýbáním konkrétních faktů. Vezmeme reálné jádro, oddělíme ho od přílepků a ukážeme mechaniku, jak se z technické zprávy stane marketingová zbraň.
OpenAI spustil omezený preview GPT-5.6 ve třech variantách Sol, Terra a Luna. Nové názvosloví, režimy max a ultra se subagenty, důraz na efektivitu tokenů. Plná dostupnost má přijít během pár týdnů.
DeepReinforce vydal Ornith-1.0, rodinu open-source coding modelů, které se učí generovat vlastní strategii řešení místo lidsky navrženého rámce. A je hodně zajímavý!
Z.ai vydala GLM-5.2 den po stažení Fable 5 vládou USA. Bez jediného benchmarku, zatím jen přes Coding Plan, váhy a API slíbeny příští týden. Načasování je celý příběh.
Moonshot vydal Kimi K2.7 Code tři dny po Claude Fable 5. Levná open-weights odpověď na frontier coding – desetina ceny, o třicet procent méně reasoning tokenů, ale benchmarky výhradně vlastní.
Anthropic právě vydal svůj nejsilnější model Claude Fable 5, první veřejně dostupný model z nové třídy, kterou nazývá Mythos-class a kterou staví nad dosavadní Opus.
MiniMax vydal model M3, nástupce M2.7. Jádrem je vlastní architektura MiniMax Sparse Attention, podpora 1M tokenů kontextu a nativní multimodalita včetně obrazu a videa.
Claude Opus 4.8Claude Opus 4.7GPT-5.5Gemini 3.1 Pro
Anthropic vydal Opus 4.8 šest týdnů po 4.7. Stejná cena, lepší benchmarky, Fast Mode za třetinu ceny a důraz na upřímnost modelu. Inkrementální skóre, kvalitativní posun v agentní práci.
Google na konferenci I/O 2026 vydal Gemini 3.5 Flash a přestavěl svou agentní platformu na Antigravity 2.0. Chybělo Gemini 3.5 Pro. Sundar Pichai oznámil, že vlajková loď přijde "až příští měsíc".
Xiaomi vydala MiMo V2.5-Pro a otevřela váhy obou variant pod MIT licencí. Model se tak stal prvním open-weights bilionovým modelem s nejlepšími benchmarkovými skóre, který lze komerčně nasadit, dotrénovat na vlastních datech a vyladit pro specializované úlohy.
Dlouho očekávaná preview verze čínského DeepSeek V4 je venku. A je to pátý čínský špičkový model za tři týdny. Ve stejném období vydaly americké laboratoře Opus 4.7 a GPT-5.5. Kadence čínských vydání nad americkou jednoznačně převažuje.
OpenAI 23. dubna 2026 vydala GPT-5.5 a nejzajímavější na něm není vyšší skóre v benchmarcích, ale **změna pozicování**. Předchozí modely OpenAI byly zamýšleni jako chytří chatboti s nástroji. GPT-5.5 je první GPT, který OpenAI explicitně popisuje jako model pro agentní práci.
Kimi K2.6Claude Opus 4.7GPT-5.4Gemini 3.1 ProGLM-5.1
Čínská společnost Moonshot AI vydala model Kimi K2.6, jen čtyři dny po Anthropic Opus 4.7. Ne náhodou právě teď. Moonshot využila pozornost zaměřenou na nové modely a představila LLM, který útočí přímo na pozici Antrhopicu. Cenou, otevřenými vahami, nativní orchestrací hejn agentů a výkonem v agentních úlohách.
Claude Opus 4.7Claude Opus 4.6GPT-5.4Gemini 3.1 Pro
Oficiální komunikace právě představeného modelu se soustředí na benchmarky, lepší zpracování obrazu a nová nastavení míry uvažování modelu. Přesnější obraz dostaneme, když vydání zařadíme do kontextu tří paralelních pohybů, které Anthropic v posledních měsících provedl. Pojďme si projít zákulisí miliardového boje o AI.
Muse SparkClaude Opus 4.6Gemini 3.1 ProGPT-5.4Grok 4.2
Meta po roce ticha vypustila Muse Spark – první výstup Meta Superintelligence Labs a první frontier model od Mety, který není open weights. Co to znamená?