Vibecoding.cz Patrick Zandl o AI vývoji

LLM Analýzy

Strategické rozbory, srovnání a retrospektivy jazykových modelů z reálného použití — ne jen benchmarky, ale zkušenosti z produkčních projektů. ← Přehled všech modelů

Reklama
Strategic

Muse Glimmer: Meta otevřela váhy modelu, který se vejde do jedné grafické karty

Muse GlimmerMuse Spark 1.2Gemma4-31BQwen3.6-27BKimi K3

Meta vydala Muse Glimmer, model o 30 miliardách parametrů s otevřenými vahami pod Apache 2.0, který běží na jedné spotřebitelské grafické kartě. Měsíc po tom, co poprvé v historii vlastní model zpoplatnila. V agentní práci vede nad konkurencí své velikosti, v jednom čísle ale zaostává právě tam, kde model prodává.

Číst analýzu →
Strategic

Alibaba Qwen 3.8-Max slibuje výkon Fable, konkuruje spíš Sonnetu

Qwen3.8-MaxClaude Fable 5GPT-5.6 SolClaude Sonnet 5Kimi K3

Alibaba představila Qwen3.8-Max jako rovnocenného soupeře Fable 5 i GPT-5.6 Sol. Nezávislé měření Artificial Analysis mu ale dalo 53 bodů, tedy přesně tolik co Sonnetu 5. Zajímavější než ten rozdíl je otázka, jestli index měří to, na co Alibaba mířila.

Číst analýzu →
Brief

Gemini 3.6 Flash a spol.: Google vydává efektivní Flash modely, ale na vlajkovou loď se pořád čeká

Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash Cyber

Google vydal tři modely třídy Flash – pracovní 3.6 Flash, úsporný 3.5 Flash-Lite a kyberbezpečnostní Flash Cyber. Nezávislé měření ale ukazuje, že chytrost 3.6 Flash zůstala na místě; posun je jen v efektivitě a ceně. Hlavní zpráva je chybějící vlajková loď – slíbený Gemini 3.5 Pro se dál zpožďuje.

Číst analýzu →
Strategic

Grok 4.5 trénovaný s Cursorem, silný kodér

Grok 4.5SWE-1.7

Grok ve verzi 4.5 je silný kódovací model. Jak by ne, naučil se na datech uživatelů Cursoru a i když je prostor ke zlepšení, dotahuje se na dohled Opusu za zlomek ceny. Jaké jsou jeho silné a slabé stránky?

Číst analýzu →
Brief

Jaký je MiMo V2.5-Pro?

MiMo V2.5-ProMimo V2.5

Xiaomi vydala MiMo V2.5-Pro a otevřela váhy obou variant pod MIT licencí. Model se tak stal prvním open-weights bilionovým modelem s nejlepšími benchmarkovými skóre, který lze komerčně nasadit, dotrénovat na vlastních datech a vyladit pro specializované úlohy.

Číst analýzu →
Brief

DeepSeek V4 - dvě velké čínské novinky

Deepseek V4-ProDeepseek V4-Flash

Dlouho očekávaná preview verze čínského DeepSeek V4 je venku. A je to pátý čínský špičkový model za tři týdny. Ve stejném období vydaly americké laboratoře Opus 4.7 a GPT-5.5. Kadence čínských vydání nad americkou jednoznačně převažuje.

Číst analýzu →
Strategic

GPT-5.5: první model OpenAI zamýšlený primárně pro agenty

GPT-5.5Opus 4.7

OpenAI 23. dubna 2026 vydala GPT-5.5 a nejzajímavější na něm není vyšší skóre v benchmarcích, ale **změna pozicování**. Předchozí modely OpenAI byly zamýšleni jako chytří chatboti s nástroji. GPT-5.5 je první GPT, který OpenAI explicitně popisuje jako model pro agentní práci.

Číst analýzu →
Srovnání

Kimi K2.6: model otevřených vah, který mění otázku, jak vybírat mezi AI modely

Kimi K2.6Claude Opus 4.7GPT-5.4Gemini 3.1 ProGLM-5.1

Čínská společnost Moonshot AI vydala model Kimi K2.6, jen čtyři dny po Anthropic Opus 4.7. Ne náhodou právě teď. Moonshot využila pozornost zaměřenou na nové modely a představila LLM, který útočí přímo na pozici Antrhopicu. Cenou, otevřenými vahami, nativní orchestrací hejn agentů a výkonem v agentních úlohách.

Číst analýzu →
Strategic

Claude Opus 4.7 - technologicky marginální, strategicky stěžejní

Claude Opus 4.7Claude Opus 4.6GPT-5.4Gemini 3.1 Pro

Oficiální komunikace právě představeného modelu se soustředí na benchmarky, lepší zpracování obrazu a nová nastavení míry uvažování modelu. Přesnější obraz dostaneme, když vydání zařadíme do kontextu tří paralelních pohybů, které Anthropic v posledních měsících provedl. Pojďme si projít zákulisí miliardového boje o AI.

Číst analýzu →