AA Coding Index
Měřeno: datum neuvedeno
Podmínky a zdroj výsledku
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
- Model ve zdroji
- moonshotai/kimi-k2-thinking
- Záznam
- openrouter.json
- Původní hodnota
- 21.0
moonshotai/kimi-k2-thinking
Kimi K2 Thinking od Moonshot AI nabízí kontext 262 144 tokenů. Popis v katalogu jej zaměřuje na práce s nástroji a agenty, analytické úlohy. OpenRouter u něj uvádí AA Coding Index 21; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Kimi K2 Thinking is Moonshot AI’s most advanced open reasoning model to date, extending the K2 series into agentic, long-horizon reasoning. Built on the trillion-parameter Mixture-of-Experts (MoE) architecture introduced in...
OpenRouter ↗Leží ve spodních 25 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 21.
Nejbližší konkurenti podle Coding Indexu
Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
| Benchmark | Výsledek | Pořadí | Nápověda |
|---|---|---|---|
| AA Coding Indexmoonshotai/kimi-k2-thinking | 21 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| Terminal-Benchkimi-k2-thinking | 35,7 % | 13/23 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchkimi-k2-thinking | 35,7 % | 6/10 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| GPQA Diamondkimi-k2-thinking-turbo | 84,22 % | 21/69 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| APEX Agentskimi-k2-thinking | 4,1 % | 35/35 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| Design Arena · websitemoonshotai/kimi-k2-thinking | 1 126 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Agent: Terminus 2 · Měřeno: 2025-11-11
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Kimi K2 Thinking
Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-11-11
Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: 2025-11-11
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Kimi K2 Thinking
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
1,38× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Úspora 1,04 USD za koš · Coding Index 20,7 (-0,3 bodu proti tomuto modelu).
Karta modelu →Úspora 0,08 USD za koš · Coding Index 68,1 (+47,1 bodu proti tomuto modelu).
Karta modelu →USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
| Nabídka | Tokenové sazby | Čtení cache | |
|---|---|---|---|
| Standardní APImoonshotai/kimi-k2-thinking | $0,6 | $2,5 | — |
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
Výstup je o 8 % levnější.
Stejná základní cena výstupu.
Stejná základní cena výstupu.
Stejná základní cena výstupu.
Výstup je o 8 % levnější.
K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.