AA Coding Index
Měřeno: datum neuvedeno
Podmínky a zdroj výsledku
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
- Model ve zdroji
- anthropic/claude-sonnet-4.5
- Záznam
- openrouter.json
- Původní hodnota
- 52.1
anthropic/claude-sonnet-4.5
Claude Sonnet 4.5 od Anthropic nabízí kontext 1 000 000 tokenů. Popis v katalogu jej zaměřuje na programování, práce s nástroji a agenty. OpenRouter u něj uvádí AA Coding Index 52.1; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.
* Základní sazba. U delších vstupů platí cenová pásma uvedená níže.
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Claude Sonnet 4.5 is Anthropic’s most advanced Sonnet model to date, optimized for real-world agents and coding workflows. It delivers state-of-the-art performance on coding benchmarks such as SWE-bench Verified, with...
OpenRouter ↗Leží ve středních 50 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 52,1.
Nejbližší konkurenti podle Coding Indexu
Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
| Benchmark | Výsledek | Pořadí | Nápověda |
|---|---|---|---|
| AA Coding Indexanthropic/claude-sonnet-4.5 | 52,1 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| CyBenchclaude-sonnet-4-5-20250929 | 55 % | 4/8 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| CyBenchclaude-sonnet-4-5-20250929_unknown | 60 % | 3/8 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| SWE-bench Verifiedclaude-sonnet-4-5-20250929 | 71,28 % | 12/15 | ⓘŘešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci. |
| SciCodeclaude-sonnet-4-5-20250929_unknown | 44,68 % | 13/44 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| Terminal-Benchclaude-sonnet-4-5-20250929 | 40,1 % | 1/3 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929 | 42,5 % | 1/5 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929 | 42,6 % | 2/5 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929 | 42,8 % | 3/10 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 46,5 % | 1/1 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 40,1 % | 3/5 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 43,1 % | 2/3 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 42,7 % | 1/1 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 42,7 % | 2/2 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 42,5 % | 1/8 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 42,6 % | 3/8 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchclaude-sonnet-4-5-20250929_unknown | 42,8 % | 8/23 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| AA Intelligence Indexanthropic/claude-sonnet-4.5 | 21,2 | — | ⓘSoubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-sonnet-4-5-20250929 | 73,74 % | 39/69 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-sonnet-4-5-20250929_16K | 78,79 % | 33/69 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-sonnet-4-5-20250929_32K | 81,73 % | 29/69 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-sonnet-4-5-20250929_59K | 82,32 % | 27/69 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Humanity’s Last Examclaude-sonnet-4-5-20250929_unknown | 13,72 % | 12/24 | ⓘZnalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Humanity’s Last Examclaude-sonnet-4-5-20250929_unknown | 7,52 % | 20/24 | ⓘZnalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| ProofBenchclaude-sonnet-4-5-20250929_unknown | 19 % | 10/20 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| AA Agentic Indexanthropic/claude-sonnet-4.5 | 17,5 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| GSOclaude-sonnet-4-5-20250929 | 14,7 % | 9/15 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| GSOclaude-sonnet-4-5-20250929_unknown | 14,71 % | 8/15 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| Design Arena · 3danthropic/claude-sonnet-4.5 | 1 190 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · asciiartanthropic/claude-sonnet-4.5 | 1 227 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · codecategoriesanthropic/claude-sonnet-4.5 | 1 199 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · datavizanthropic/claude-sonnet-4.5 | 1 183 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · gamedevanthropic/claude-sonnet-4.5 | 1 190 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · svganthropic/claude-sonnet-4.5 | 1 142 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · uicomponentanthropic/claude-sonnet-4.5 | 1 191 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · websiteanthropic/claude-sonnet-4.5 | 1 203 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · fullstackanthropic/claude-sonnet-4.5 | 1 057 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · mobileappsanthropic/claude-sonnet-4.5 | 1 174 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · webappsanthropic/claude-sonnet-4.5 | 1 080 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Thinking level unknown. "Results for Claude 4.5 Sonnet, Claude 4.1 Opus, Claude 4 Opus, and Claude 4 Sonnet are from the Claude 4.5 Sonnet System Card on a subset of 37 problems. Percentages are estimates based on probability of success on 1 trial."
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Results from Opus 4.5 system card, also reported on the official Cybench leaderboard
Měřeno: 2026-02-05
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude 4.5 Sonnet (Reasoning)
Agent: Claude Code · Verze: 2.0 · Měřeno: 2025-11-04
Effort není doložen Úplná konfigurace běhu není ověřena
Agent: Mini-SWE-Agent · Verze: 2.0 · Měřeno: 2025-11-03
Effort není doložen Úplná konfigurace běhu není ověřena
Agent: OpenHands · Verze: 2.0 · Měřeno: 2025-11-02
Effort není doložen Úplná konfigurace běhu není ověřena
Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-10-31
Effort není doložen Úplná konfigurace běhu není ověřena
Agent: CAMEL-AI · Měřeno: 2025-12-24
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Sonnet 4.5
Agent: Claude Code · Měřeno: 2025-11-04
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Sonnet 4.5
Agent: Goose · Měřeno: 2025-12-11
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Sonnet 4.5
Agent: MAYA · Měřeno: 2026-01-04
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude 4.5 Sonnet
Agent: MAYA-V2 · Verze: 2.0 · Měřeno: 2026-01-04
Effort není doložen Úplná konfigurace běhu není ověřena
Claude 4.5 Sonnet
Agent: Mini-SWE-Agent · Měřeno: 2025-11-03
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Sonnet 4.5
Agent: OpenHands · Měřeno: 2025-11-02
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Sonnet 4.5
Agent: Terminus 2 · Měřeno: 2025-10-31
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Sonnet 4.5
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Měřeno: 2025-09-29
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: 2025-10-28
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: 2025-10-21
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: 2025-10-28
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
claude-sonnet-4-5-20250929-thinking
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
claude-sonnet-4-5-20250929
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
ProofBench v1.0-era value; model absent from the v1.1 board (vals.ai re-grade 2026-08-14, methodology changed) and not re-run. Not comparable to v1.1 rows. Annotated 2026-08-18.
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
7,5× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Úspora 5,97 USD za koš · Coding Index 50,6 (-1,5 bodu proti tomuto modelu).
Karta modelu →Stejná cena koše · Coding Index 76,2 (+24,1 bodu proti tomuto modelu).
Karta modelu →USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
| Nabídka | Tokenové sazby | Čtení cache | |
|---|---|---|---|
| Standardní APIanthropic/claude-sonnet-4.5 | $3 | $15 | $0,3 |
| ↳ od 200 000 vstupních tokenů | $6 | $22,5 | $0,6 |
| Batchanthropic/claude-sonnet-4.5:batch | $1,5 | $7,5 | $0,15 |
| ↳ od 200 000 vstupních tokenů | $3 | $11,25 | $0,3 |
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
Výstup je o 73 % levnější.
Výstup je o 50 % levnější.
Výstup je o 33,3 % levnější.
Stejná základní cena výstupu.
Stejná základní cena výstupu.
K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.