AA Coding Index
Měřeno: datum neuvedeno
Podmínky a zdroj výsledku
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
- Model ve zdroji
- openai/gpt-oss-20b
- Záznam
- openrouter.json
- Původní hodnota
- 20.7
openai/gpt-oss-20b
gpt-oss-20b od OpenAI nabízí kontext 131 072 tokenů. OpenRouter u něj uvádí AA Coding Index 20.7; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
gpt-oss-20b is an open-weight 21B parameter model released by OpenAI under the Apache 2.0 license. It uses a Mixture-of-Experts (MoE) architecture with 3.6B active parameters per forward pass, optimized for...
OpenRouter ↗Leží ve spodních 25 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 20,7.
Nejbližší konkurenti podle Coding Indexu
Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
| Benchmark | Výsledek | Pořadí | Nápověda |
|---|---|---|---|
| AA Coding Indexopenai/gpt-oss-20b | 20,7 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| SciCodegpt-oss-20b_high | 34,38 % | 20/20 | ⓘTvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ. |
| Terminal-Benchgpt-oss-20b | 3,4 % | 5/5 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchgpt-oss-20b | 3,1 % | 10/10 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchgpt-oss-20b_unknown | 3,4 % | 8/8 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| Terminal-Benchgpt-oss-20b_unknown | 3,1 % | 23/23 | ⓘBenchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům. |
| AA Intelligence Indexopenai/gpt-oss-20b | 9 | — | ⓘSoubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondgpt-oss-20b_high | 45,96 % | 25/25 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondgpt-oss-20b_low | 53,16 % | 22/22 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| GPQA Diamondgpt-oss-20b_medium | 60,8 % | 12/12 | ⓘVýsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| AA Agentic Indexopenai/gpt-oss-20b | 1,4 | — | ⓘOpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky. |
| Design Arena · datavizopenai/gpt-oss-20b | 948 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
| Design Arena · websiteopenai/gpt-oss-20b | 866 Elo | — | ⓘHodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání. |
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Effort: high · Měřeno: datum neuvedeno
Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
gpt-oss-20B (high)
Agent: Mini-SWE-Agent · Verze: 2.0 · Měřeno: 2025-11-03
Effort není doložen Úplná konfigurace běhu není ověřena
Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-11-01
Effort není doložen Úplná konfigurace běhu není ověřena
Agent: Mini-SWE-Agent · Měřeno: 2025-11-03
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
GPT-OSS-20B
Agent: Terminus 2 · Měřeno: 2025-11-01
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
GPT-OSS-20B
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Effort: high · Měřeno: 2026-08-06
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: low · Měřeno: 2026-08-27
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Effort: medium · Měřeno: 2026-08-27
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
Měřeno: datum neuvedeno
Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
Měřeno: datum neuvedeno
Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.
0,07× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Úspora 0 USD za koš · Coding Index 52,7 (+32 bodu proti tomuto modelu).
Karta modelu →Příplatek 0,01 USD za koš · Coding Index 30,4 (+9,7 bodu proti tomuto modelu).
Karta modelu →USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
| Nabídka | Tokenové sazby | Čtení cache | |
|---|---|---|---|
| Standardní APIopenai/gpt-oss-20b | $0,03 | $0,13 | $0,03 |
| Batchopenai/gpt-oss-20b:batch | $0,05 | $0,2 | — |
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
Výstup je o 92,3 % dražší.
Výstup je o 15,4 % dražší.
Výstup je o 53,8 % dražší.
Výstup je o 30,8 % dražší.
Výstup je o 207,7 % dražší.
K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.