Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · OpenAI

GPT-5

openai/gpt-5

Porovnat model ↗

GPT-5 od OpenAI nabízí kontext 400 000 tokenů. Popis v katalogu jej zaměřuje na programování, analytické úlohy. OpenRouter u něj uvádí AA Coding Index 37.8; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

Obrazový vstupNástroje
Vstup / 1M tokenů$1,25
Výstup / 1M tokenů$10
Kontext400 k
Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Popis z OpenRouteru v původním znění

GPT-5 is OpenAI’s most advanced model, offering major improvements in reasoning, code quality, and user experience. It is optimized for complex tasks that require step-by-step reasoning, instruction following, and accuracy...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index74. z 125 modelů

Publikovaný AA Coding Index

Leží ve středních 50 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 37,8.

GPT-5
Nejvyšší indexyVyšší indexyStředNižší indexy

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexopenai/gpt-537,8

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

Aider Polyglotgpt-5-2025-08-07_high88 %1/8

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

Aider Polyglotgpt-5-2025-08-07_low81,3 %1/1

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

Aider Polyglotgpt-5-2025-08-07_medium86,7 %1/3

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

SWE-bench Verifiedgpt-5-2025-08-07_high73,55 %5/7

Řešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci.

SWE-bench Verifiedgpt-5-2025-08-07_medium71,49 %1/3

Řešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci.

SciCodegpt-5-2025-08-07_unknown42,94 %18/44

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

Terminal-Benchgpt-5-2025-08-07_medium49,6 %2/4

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5-2025-08-07_medium33,9 %1/3

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5-2025-08-07_medium43,8 %1/5

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5-2025-08-07_medium35,2 %1/3

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5-2025-08-07_unknown49,6 %2/4

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5-2025-08-07_unknown33,9 %3/8

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5-2025-08-07_unknown43,8 %2/8

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

Terminal-Benchgpt-5-2025-08-07_unknown35,2 %14/23

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

GPQA Diamondgpt-5-2025-08-07_high86,17 %11/25

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5-2025-08-07_medium85,35 %3/12

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5-2025-08-07_minimal71,72 %7/9

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Humanity’s Last Examgpt-5-2025-08-07_high25,32 %1/3

Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Humanity’s Last Examgpt-5-2025-08-07_unknown25,32 %5/24

Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

ProofBenchgpt-5-2025-08-07_high18 %5/11

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

APEX Agentsgpt-5-2025-08-07_high18,3 %4/7

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

APEX Agentsgpt-5-2025-08-07_unknown18,3 %21/35

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

GSOgpt-5-2025-08-07_high6,86 %7/9

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · 3dopenai/gpt-51 088 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · asciiartopenai/gpt-51 163 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · codecategoriesopenai/gpt-51 184 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizopenai/gpt-51 238 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevopenai/gpt-51 208 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · svgopenai/gpt-51 216 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentopenai/gpt-51 198 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/gpt-51 198 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

37,8
Střední pásmo74. z 125 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
37.8
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: high · Měřeno: 2025-08-23

88 %
Malý vzorek — bez výkonové třídy1. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_high
Záznam
aider_polyglot_external.csv: řádek 9
Původní hodnota
88.0
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: low · Měřeno: 2025-08-25

81,3 %
Malý vzorek — bez výkonové třídy1. z 1 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_low
Záznam
aider_polyglot_external.csv: řádek 7
Původní hodnota
81.3
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: medium · Měřeno: 2025-08-25

86,7 %
Malý vzorek — bez výkonové třídy1. z 3 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_medium
Záznam
aider_polyglot_external.csv: řádek 8
Původní hodnota
86.7
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

SWE-bench Verified

Effort: high · Měřeno: 2026-02-06

73,55 %
Malý vzorek — bez výkonové třídy5. z 7 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_high
Záznam
swe_bench_verified.csv: řádek 30
Původní hodnota
0.7355371900826446 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

SWE-bench Verified

Effort: medium · Měřeno: 2026-02-05

71,49 %
Malý vzorek — bez výkonové třídy1. z 3 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_medium
Záznam
swe_bench_verified.csv: řádek 34
Původní hodnota
0.7148760330578512 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 26 výsledků a konfigurací
Epoch · převzatý běh

SciCode

Měřeno: datum neuvedeno

42,94 %
Pořadí ve zdrojovém snapshotu18. z 44 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5 (high)

Model ve zdroji
gpt-5-2025-08-07_unknown
Záznam
scicode_external.csv: řádek 70
Původní hodnota
0.429398148148148 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Codex CLI · Effort: medium · Verze: 2.0 · Měřeno: 2025-11-04

49,6 %
Malý vzorek — bez výkonové třídy2. z 4 modelůPořadí běhů se stejným uvedeným testem, agentem a effortem. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_medium
Záznam
terminalbench_external.csv: řádek 76
Původní hodnota
0.496 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Effort: medium · Verze: 2.0 · Měřeno: 2025-11-03

33,9 %
Malý vzorek — bez výkonové třídy1. z 3 modelůPořadí běhů se stejným uvedeným testem, agentem a effortem. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_medium
Záznam
terminalbench_external.csv: řádek 127
Původní hodnota
0.339 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: OpenHands · Verze: 2.0 · Měřeno: 2025-11-02

43,8 %
Malý vzorek — bez výkonové třídy1. z 5 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena Effort je ve zdroji pouze předpokládaný; nepoužíváme pro srovnání.

Medium thinking used in other GPT-5 evaluations, assuming the same here.

Model ve zdroji
gpt-5-2025-08-07_medium
Záznam
terminalbench_external.csv: řádek 85
Původní hodnota
0.438 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Effort: medium · Verze: 2.0 · Měřeno: 2025-10-31

35,2 %
Malý vzorek — bez výkonové třídy1. z 3 modelůPořadí běhů se stejným uvedeným testem, agentem a effortem. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_medium
Záznam
terminalbench_external.csv: řádek 120
Původní hodnota
0.352 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Codex CLI · Měřeno: 2025-11-04

49,6 %
Malý vzorek — bez výkonové třídy2. z 4 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5

Model ve zdroji
gpt-5-2025-08-07_unknown
Záznam
terminalbench_external.csv: řádek 75
Původní hodnota
0.49600000000000005 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Mini-SWE-Agent · Měřeno: 2025-11-03

33,9 %
Malý vzorek — bez výkonové třídy3. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5

Model ve zdroji
gpt-5-2025-08-07_unknown
Záznam
terminalbench_external.csv: řádek 128
Původní hodnota
0.33899999999999997 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: OpenHands · Měřeno: 2025-11-02

43,8 %
Malý vzorek — bez výkonové třídy2. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5

Model ve zdroji
gpt-5-2025-08-07_unknown
Záznam
terminalbench_external.csv: řádek 86
Původní hodnota
0.438 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: Terminus 2 · Měřeno: 2025-10-31

35,2 %
Pořadí ve zdrojovém snapshotu14. z 23 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5

Model ve zdroji
gpt-5-2025-08-07_unknown
Záznam
terminalbench_external.csv: řádek 119
Původní hodnota
0.35200000000000004 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: high · Měřeno: 2025-10-29

86,17 %
Pořadí ve zdrojovém snapshotu11. z 25 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_high
Záznam
gpqa_diamond.csv: řádek 189
Původní hodnota
0.8617424242424242 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: medium · Měřeno: 2025-08-07

85,35 %
Pořadí ve zdrojovém snapshotu3. z 12 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_medium
Záznam
gpqa_diamond.csv: řádek 199
Původní hodnota
0.8535353535353535 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: minimal · Měřeno: 2026-07-20

71,72 %
Malý vzorek — bez výkonové třídy7. z 9 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_minimal
Záznam
gpqa_diamond.csv: řádek 127
Původní hodnota
0.7171717171717171 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Humanity’s Last Exam

Effort: high · Měřeno: datum neuvedeno

25,32 %
Malý vzorek — bez výkonové třídy1. z 3 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-5-2025-08-07

Model ve zdroji
gpt-5-2025-08-07_high
Záznam
hle_external.csv: řádek 12
Původní hodnota
0.2532 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Humanity’s Last Exam

Měřeno: datum neuvedeno

25,32 %
Pořadí ve zdrojovém snapshotu5. z 24 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

gpt-5-2025-08-07

Model ve zdroji
gpt-5-2025-08-07_unknown
Záznam
hle_external.csv: řádek 13
Původní hodnota
0.2532 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ProofBench

Effort: high · Měřeno: datum neuvedeno

18 %
Pořadí ve zdrojovém snapshotu5. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

ProofBench v1.0-era value; model absent from the v1.1 board (vals.ai re-grade 2026-08-14, methodology changed) and not re-run. Not comparable to v1.1 rows. Annotated 2026-08-18.

Model ve zdroji
gpt-5-2025-08-07_high
Záznam
proofbench_external.csv: řádek 40
Původní hodnota
0.18 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Effort: high · Měřeno: datum neuvedeno

18,3 %
Malý vzorek — bez výkonové třídy4. z 7 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT 5

Model ve zdroji
gpt-5-2025-08-07_high
Záznam
apex_agents_external.csv: řádek 40
Původní hodnota
0.18300000000000002 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Měřeno: datum neuvedeno

18,3 %
Pořadí ve zdrojovém snapshotu21. z 35 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5

Model ve zdroji
gpt-5-2025-08-07_unknown
Záznam
apex_agents_external.csv: řádek 41
Původní hodnota
0.18300000000000002 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

GSO

Effort: high · Měřeno: datum neuvedeno

6,86 %
Malý vzorek — bez výkonové třídy7. z 9 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5-2025-08-07_high
Záznam
gso_external.csv: řádek 24
Původní hodnota
0.06860000000000001 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · 3d

Měřeno: datum neuvedeno

1 088 Elo
Nižší výsledek78. z 98 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1088.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · asciiart

Měřeno: datum neuvedeno

1 163 Elo
Střední pásmo38. z 59 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1163.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

1 184 Elo
Střední pásmo57. z 106 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1184.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

1 238 Elo
Střední pásmo34. z 104 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1238.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 208 Elo
Střední pásmo43. z 105 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1208.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · svg

Měřeno: datum neuvedeno

1 216 Elo
Střední pásmo20. z 74 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1216.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

1 198 Elo
Střední pásmo48. z 102 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1198.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

1 198 Elo
Střední pásmo55. z 112 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5
Záznam
openrouter.json
Původní hodnota
1198.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Vyšší cena61. z 309 modelů · sdílené pořadí od nejdražšího

3,25 USD za srovnávací koš

4,06× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

GPT-5
NejdražšíVyšší cenaStředNízká cena

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

Vyšší index za podobnou cenu

Grok 4.6

Úspora 0,05 USD za koš · Coding Index 76,8 (+39 bodu proti tomuto modelu).

Karta modelu →

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/gpt-5$1,25$10$0,125
Batchopenai/gpt-5:batch$0,625$5$0,0625
Vstupní modality
text, image, file
Volání nástrojů
Ano
Do katalogu přidán
2025-08-07
Znalostní cutoff
2024-09-30
Kanonická verze
openai/gpt-5-2025-08-07
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.