Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · OpenAI

gpt-oss-120b

openai/gpt-oss-120b

Porovnat model ↗

gpt-oss-120b od OpenAI nabízí kontext 131 072 tokenů. Popis v katalogu jej zaměřuje na práce s nástroji a agenty, analytické úlohy. OpenRouter u něj uvádí AA Coding Index 30.4; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

NástrojeHF repozitář
Vstup / 1M tokenů$0,037
Výstup / 1M tokenů$0,17
Kontext131,1 k
Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Popis z OpenRouteru v původním znění

gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose production use cases. It activates 5.1B parameters per forward pass and is optimized...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index84. z 125 modelů

Publikovaný AA Coding Index

Leží ve středních 50 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 30,4.

gpt-oss-120b
Nejvyšší indexyVyšší indexyStředNižší indexy

Nejbližší konkurenti podle Coding Indexu

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexopenai/gpt-oss-120b30,4

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

Aider Polyglotgpt-oss-120b_high41,8 %7/8

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

Aider Polyglotopenai/gpt-oss-120b_high41,8 %7/8

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

SciCodeopenai/gpt-oss-120b_high38,89 %19/20

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

SciCodeopenai/gpt-oss-120b_low36 %13/13

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

Terminal-Benchgpt-oss-120b14,2 %4/5

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-120b18,7 %9/10

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-120b_unknown14,2 %6/8

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-oss-120b_unknown18,7 %21/23

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

AA Intelligence Indexopenai/gpt-oss-120b12,3

Soubor především textových úloh v angličtině; není testem češtiny. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondopenai/gpt-oss-120b_high75,76 %22/25

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

AA Agentic Indexopenai/gpt-oss-120b6,2

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

APEX Agentsgpt-oss-120b4,7 %34/35

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · 3dopenai/gpt-oss-120b933 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · codecategoriesopenai/gpt-oss-120b979 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizopenai/gpt-oss-120b1 003 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevopenai/gpt-oss-120b1 015 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentopenai/gpt-oss-120b945 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/gpt-oss-120b981 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

30,4
Střední pásmo84. z 125 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
30.4
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: high · Měřeno: datum neuvedeno

41,8 %
Malý vzorek — bez výkonové třídy7. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-120b_high
Záznam
aider_polyglot_external.csv: řádek 2
Původní hodnota
41.8
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: high · Měřeno: 2025-08-06

41,8 %
Malý vzorek — bez výkonové třídy7. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
openai/gpt-oss-120b_high
Záznam
aider_polyglot_external.csv: řádek 76
Původní hodnota
41.8
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: high · Měřeno: datum neuvedeno

38,89 %
Pořadí ve zdrojovém snapshotu19. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-oss-120b (high)

Model ve zdroji
openai/gpt-oss-120b_high
Záznam
scicode_external.csv: řádek 34
Původní hodnota
0.388888888888889 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: low · Měřeno: datum neuvedeno

36 %
Pořadí ve zdrojovém snapshotu13. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-oss-120b (low)

Model ve zdroji
openai/gpt-oss-120b_low
Záznam
scicode_external.csv: řádek 130
Původní hodnota
0.35995370370370405 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Verze: 2.0 · Měřeno: 2025-11-03

14,2 %
Malý vzorek — bez výkonové třídy4. z 5 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-120b
Záznam
terminalbench_external.csv: řádek 188
Původní hodnota
0.142 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 13 výsledků a konfigurací
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Verze: 2.0 · Měřeno: 2025-11-01

18,7 %
Pořadí ve zdrojovém snapshotu9. z 10 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-oss-120b
Záznam
terminalbench_external.csv: řádek 175
Původní hodnota
0.187 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Měřeno: 2025-11-03

14,2 %
Malý vzorek — bez výkonové třídy6. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-OSS-120B

Model ve zdroji
gpt-oss-120b_unknown
Záznam
terminalbench_external.csv: řádek 189
Původní hodnota
0.142 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Měřeno: 2025-11-01

18,7 %
Pořadí ve zdrojovém snapshotu21. z 23 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-OSS-120B

Model ve zdroji
gpt-oss-120b_unknown
Záznam
terminalbench_external.csv: řádek 176
Původní hodnota
0.187 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Intelligence Index

Měřeno: datum neuvedeno

12,3
Střední pásmo62. z 85 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
12.3
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: high · Měřeno: 2025-12-11

75,76 %
Pořadí ve zdrojovém snapshotu22. z 25 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
openai/gpt-oss-120b_high
Záznam
gpqa_diamond.csv: řádek 175
Původní hodnota
0.7575757575757576 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Artificial Analysis přes OpenRouter

AA Agentic Index

Měřeno: datum neuvedeno

6,2
Střední pásmo62. z 94 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
6.2
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Měřeno: datum neuvedeno

4,7 %
Pořadí ve zdrojovém snapshotu34. z 35 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT OSS 120B

Model ve zdroji
gpt-oss-120b
Záznam
apex_agents_external.csv: řádek 60
Původní hodnota
0.047 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · 3d

Měřeno: datum neuvedeno

933 Elo
Nižší výsledek92. z 98 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
933.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

979 Elo
Nižší výsledek100. z 106 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
979.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

1 003 Elo
Nižší výsledek95. z 104 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
1003.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 015 Elo
Nižší výsledek91. z 105 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
1015.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

945 Elo
Nižší výsledek97. z 102 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
945.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

981 Elo
Nižší výsledek103. z 112 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-oss-120b
Záznam
openrouter.json
Původní hodnota
981.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Nízká cena294. z 309 modelů od nejdražšího

0,07 USD za srovnávací koš

0,09× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

gpt-oss-120b
NejdražšíVyšší cenaStředNízká cena

Nejbližší konkurenti podle ceny koše

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

Nejbližší nižší index levněji

gpt-oss-20b

Úspora 0,01 USD za koš · Coding Index 20,7 (-9,7 bodu proti tomuto modelu).

Karta modelu →

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/gpt-oss-120b$0,037$0,17
Batchopenai/gpt-oss-120b:batch$0,15$0,6
Vstupní modality
text
Volání nástrojů
Ano
Do katalogu přidán
2025-08-05
Znalostní cutoff
2024-06-30
Kanonická verze
openai/gpt-oss-120b
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.