AA Coding Index
Měřeno: datum neuvedeno
Podmínky a zdroj výsledku
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
- Model ve zdroji
- anthropic/claude-opus-4.7
- Záznam
- openrouter.json
- Původní hodnota
- 73.6
anthropic/claude-opus-4.7
Claude Opus 4.7 od Anthropic nabízí kontext 1 000 000 tokenů. Popis v katalogu jej zaměřuje na programování, práce s nástroji a agenty. OpenRouter u něj uvádí AA Coding Index 73.6; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Opus 4.7 is the next generation of Anthropic's Opus family, built for long-running, asynchronous agents. Building on the coding and agentic strengths of Opus 4.6, it delivers stronger performance on...
OpenRouter ↗Patří do nejlepších 25 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 73,6.
Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
| Benchmark | Výsledek | Pořadí | Nápověda |
|---|---|---|---|
| AA Coding Indexanthropic/claude-opus-4.7 | 73,6 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| CursorBenchclaude-opus-4-7_high | 59,4 % | 9/17 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-4-7_low | 48,3 % | 9/14 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-4-7_max | 64,8 % | 6/12 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-4-7_medium | 52,7 % | 10/15 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| CursorBenchclaude-opus-4-7_xhigh | 61,6 % | 6/11 | ⓘNejednoznačné úlohy přes více souborů z reálného používání Cursoru. Měří běh v prostředí Cursoru, ne samostatný model v libovolném nástroji. |
| ExploitBenchclaude-opus-4-7 | 26,5 % | 3/14 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| ExploitBenchclaude-opus-4-7 | 23,9 % | 4/14 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| FrontierCodeclaude-opus-4-7_unknown | 38,54 % | 2/3 | ⓘHodnotí kvalitu změn kódu pro produkční repozitáře. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| MirrorCodeclaude-opus-4-7_high | 31,11 % | 3/6 | ⓘModel znovu implementuje program bez přístupu k jeho původnímu zdrojovému kódu. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| SWE-bench Verifiedclaude-opus-4-7_max | 83,47 % | 1/3 | ⓘŘešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci. |
| SciCodeclaude-opus-4-7_max | 54,51 % | 8/20 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| Terminal-Benchclaude-opus-4-7_unknown | 80,2 % | 1/1 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| GPQA Diamondclaude-opus-4-7_max | 86,36 % | 15/18 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondclaude-opus-4-7_xhigh | 90,15 % | 8/11 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Humanity’s Last Examclaude-opus-4-7_unknown | 36,2 % | 2/24 | ⓘZnalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| ProofBenchclaude-opus-4-7_max | 54 % | 8/14 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| AA Agentic Indexanthropic/claude-opus-4.7 | 39,5 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| APEX Agentsclaude-opus-4-7_max | 33,9 % | 4/5 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| GSOclaude-opus-4-7 | 44,12 % | 2/15 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| GSOclaude-opus-4-7_high | 44,12 % | 1/9 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| OSWorld 2claude-opus-4-7_max | 18,2 % | 5/7 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
| OSWorld 2claude-opus-4-7_max | 13,9 % | 6/7 | ⓘVýznam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu. |
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Agent: Cursor · Effort: high · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 4.7 High
Agent: Cursor · Effort: low · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 4.7 Low
Agent: Cursor · Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 4.7 Max
Agent: Cursor · Effort: medium · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 4.7 Medium
Agent: Cursor · Effort: xhigh · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 4.7 Extra High
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Opus 4.7 (AutoNudge)
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Opus 4.7
Agent: claude-code · Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 4.7
Effort: high · Měřeno: 2026-08-12
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: max · Měřeno: 2026-04-20
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
Agent: WOZCODE · Verze: 2.0 · Měřeno: 2026-05-14
Effort není doložen Úplná konfigurace běhu není ověřena
Claude Opus 4.7
Effort: max · Měřeno: 2026-08-06
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: xhigh · Měřeno: 2026-04-17
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Claude Opus 4.7
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
ProofBench v1.0-era value; model absent from the v1.1 board (vals.ai re-grade 2026-08-14, methodology changed) and not re-run. Not comparable to v1.1 rows. Annotated 2026-08-18.
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Opus 4.7
Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
Effort: high · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 4.7 (max)
Effort: max · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Claude Opus 4.7 (max)
12,5× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Úspora 9,88 USD za koš · Coding Index 71,5 (-2,1 bodu proti tomuto modelu).
Karta modelu →Stejná cena koše · Coding Index 78 (+4,4 bodu proti tomuto modelu).
Karta modelu →USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
| Nabídka | Tokenové sazby | Čtení cache | |
|---|---|---|---|
| Standardní APIanthropic/claude-opus-4.7 | $5 | $25 | $0,5 |
| Batchanthropic/claude-opus-4.7:batch | $2,5 | $12,5 | $0,25 |
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
Výstup je o 40 % levnější.
Výstup je o 52 % levnější.
Výstup je o 40 % levnější.
Stejná základní cena výstupu.
Stejná základní cena výstupu.
„Dubnové vydání GPT-5.5 uzavírá sérii šesti frontier modelů za osm dnů: Opus 4.7, Kimi K2.6, Qwen 3.6-Max, MiMo V2.5-Pro, GPT-5.5, DeepSeek V4. Nejhustší období vydání v historii oboru.“
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.