Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · Moonshot AI

Kimi K2 Thinking

moonshotai/kimi-k2-thinking

Porovnat model ↗

Kimi K2 Thinking od Moonshot AI nabízí kontext 262 144 tokenů. Popis v katalogu jej zaměřuje na práce s nástroji a agenty, analytické úlohy. OpenRouter u něj uvádí AA Coding Index 21; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

NástrojeHF repozitář
Vstup / 1M tokenů$0,6
Výstup / 1M tokenů$2,5
Kontext262,1 k
Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Popis z OpenRouteru v původním znění

Kimi K2 Thinking is Moonshot AI’s most advanced open reasoning model to date, extending the K2 series into agentic, long-horizon reasoning. Built on the trillion-parameter Mixture-of-Experts (MoE) architecture introduced in...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index97. z 125 modelů

Publikovaný AA Coding Index

Leží ve spodních 25 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 21.

Kimi K2 Thinking
Nejvyšší indexyVyšší indexyStředNižší indexy

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexmoonshotai/kimi-k2-thinking21

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

Terminal-Benchkimi-k2-thinking35,7 %13/23

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchkimi-k2-thinking35,7 %6/10

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

GPQA Diamondkimi-k2-thinking-turbo84,22 %21/69

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

APEX Agentskimi-k2-thinking4,1 %35/35

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · websitemoonshotai/kimi-k2-thinking1 126 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

21
Nižší výsledek97. z 125 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
moonshotai/kimi-k2-thinking
Záznam
openrouter.json
Původní hodnota
21.0
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Měřeno: 2025-11-11

35,7 %
Pořadí ve zdrojovém snapshotu13. z 23 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

Kimi K2 Thinking

Model ve zdroji
kimi-k2-thinking
Záznam
terminalbench_external.csv: řádek 116
Původní hodnota
0.35700000000000004 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-11-11

35,7 %
Pořadí ve zdrojovém snapshotu6. z 10 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
kimi-k2-thinking
Záznam
terminalbench_external.csv: řádek 117
Původní hodnota
0.357 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Měřeno: 2025-11-11

84,22 %
Pořadí ve zdrojovém snapshotu21. z 69 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
kimi-k2-thinking-turbo
Záznam
gpqa_diamond.csv: řádek 186
Původní hodnota
0.8421717171717171 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Měřeno: datum neuvedeno

4,1 %
Pořadí ve zdrojovém snapshotu35. z 35 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

Kimi K2 Thinking

Model ve zdroji
kimi-k2-thinking
Záznam
apex_agents_external.csv: řádek 61
Původní hodnota
0.040999999999999995 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

1 126 Elo
Střední pásmo82. z 112 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
moonshotai/kimi-k2-thinking
Záznam
openrouter.json
Původní hodnota
1126.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Střední cenové pásmo124. z 309 modelů · sdílené pořadí od nejdražšího

1,1 USD za srovnávací koš

1,38× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

Kimi K2 Thinking
NejdražšíVyšší cenaStředNízká cena

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

Vyšší index za podobnou cenu

Qwen3.8 27B

Úspora 0,08 USD za koš · Coding Index 68,1 (+47,1 bodu proti tomuto modelu).

Karta modelu →

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APImoonshotai/kimi-k2-thinking$0,6$2,5
Vstupní modality
text
Volání nástrojů
Ano
Do katalogu přidán
2025-11-06
Znalostní cutoff
Neuvedeno
Kanonická verze
moonshotai/kimi-k2-thinking-20251106
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od Moonshot AI

Co jsme o modelu napsali

K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.