Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · OpenAI

GPT-5.4

openai/gpt-5.4

Porovnat model ↗

GPT-5.4 od OpenAI nabízí kontext 1 050 000 tokenů. Popis v katalogu jej zaměřuje na programování. OpenRouter u něj uvádí AA Coding Index 71.1; jde o převzatý index s neuvedenou konfigurací, nikoli vlastní test.

Obrazový vstupNástroje
Vstup / 1M tokenů$2,5
Výstup / 1M tokenů$15
Kontext1,05 M

* Základní sazba. U delších vstupů platí cenová pásma uvedená níže.

Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Čtěte také: Kimi K2.6: model otevřených vah, který mění otázku, jak vybírat mezi AI modely →
Popis z OpenRouteru v původním znění

GPT-5.4 is OpenAI’s latest frontier model, unifying the Codex and GPT lines into a single system. It features a 1M+ token context window (922K input, 128K output) with support for...

OpenRouter ↗

Co ukazují výsledky

Publikovaný index23. z 125 modelů

Publikovaný AA Coding Index

Patří do nejlepších 25 % zveřejněných hodnot AA Coding Indexu v celém načteném katalogu OpenRouteru. Hodnota modelu: 71,1.

GPT-5.4
Nejvyšší indexyVyšší indexyStředNižší indexy

Pořadí publikovaných indexů, nikoli závěr vlastního testu. API neuvádí verzi indexu ani effort; první místo neznamená nejlepší model pro každou programovací úlohu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
AA Coding Indexopenai/gpt-5.471,1

OpenRouter publikuje tuto hodnotu indexu. Použitou revizi metodiky a konfiguraci zde neuvádí. Popis dostupnosti indexu není výkladem neznámé revize jeho metodiky.

DeepSWEgpt-5-451,77 %

Výsledek řešení softwarových úloh v jednotném agentním prostředí. Neprokazuje stejný výkon v jiném agentu ani kvalitu češtiny.

MirrorCodegpt-5.4-2026-03-05_high15,56 %5/6

Model znovu implementuje program bez přístupu k jeho původnímu zdrojovému kódu. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

SWE-bench Verifiedgpt-5.4-2026-03-05_high76,86 %2/7

Řešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci.

SciCodegpt-5.4-2026-03-05_xhigh56,6 %2/13

Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.

Terminal-Benchgpt-5.4-2026-03-05_unknown81,8 %1/2

Benchmark agentní práce; konkrétní úlohy a verze se musí ověřit u daného běhu. Současná homepage popisuje jinou revizi; nepřiřazuje verzi historickým řádkům.

GPQA Diamondgpt-5.4-2026-03-05_high89,9 %8/25

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_low84,85 %9/22

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_medium88,89 %1/12

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_none74,75 %13/24

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondgpt-5.4-2026-03-05_xhigh93,3 %4/11

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Humanity’s Last Examgpt-5.4-2026-03-05_xhigh36,24 %2/2

Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

ProofBenchgpt-5.4-2026-03-05_xhigh56 %2/5

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

APEX Agentsgpt-5.4-2026-03-05_unknown34,9 %9/35

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

APEX Agentsgpt-5.4-2026-03-05_xhigh36 %3/4

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

GSOgpt-5.4-2026-03-05_high25,49 %4/9

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

GSOgpt-5.4-2026-03-05_xhigh31,37 %2/2

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · 3dopenai/gpt-5.41 134 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · asciiartopenai/gpt-5.41 221 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · codecategoriesopenai/gpt-5.41 228 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizopenai/gpt-5.41 251 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevopenai/gpt-5.41 262 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · svgopenai/gpt-5.41 222 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentopenai/gpt-5.41 258 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/gpt-5.41 233 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · androidnativeopenai/gpt-5.41 047 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · fullstackopenai/gpt-5.41 024 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · godotgamedevopenai/gpt-5.41 135 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · mobileappsopenai/gpt-5.41 123 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · webappsopenai/gpt-5.41 079 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Artificial Analysis přes OpenRouter

AA Coding Index

Měřeno: datum neuvedeno

71,1
Vysoký výkon23. z 125 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Převzato z OpenRouteru; verze indexu, effort a datum měření nejsou v API uvedeny.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
71.1
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

DeepSWE

Agent: mini-swe-agent · Effort: xhigh · Verze: 1.1 · Měřeno: datum neuvedeno

51,77 %

Pořadí ve zdroji není uvedeno.

Podmínky a zdroj výsledku

Datum jednotlivého běhu a číslo verze balíčku agenta zdroj neuvádí. Pořadí závisí na konfiguraci; stejný effort různých dodavatelů není stejný rozpočet.

Model ve zdroji
gpt-5-4
Záznam
deepswe.json
Původní hodnota
0.5176991150442478 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

MirrorCode

Effort: high · Měřeno: 2026-08-10

15,56 %
Malý vzorek — bez výkonové třídy5. z 6 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
mirrorcode.csv: řádek 6
Původní hodnota
0.15555555555555556 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

SWE-bench Verified

Effort: high · Měřeno: 2026-03-06

76,86 %
Malý vzorek — bez výkonové třídy2. z 7 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
swe_bench_verified.csv: řádek 12
Původní hodnota
0.768595041322314 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

SciCode

Effort: xhigh · Měřeno: datum neuvedeno

56,6 %
Pořadí ve zdrojovém snapshotu2. z 13 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT-5.4 (xhigh)

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
scicode_external.csv: řádek 4
Původní hodnota
0.565972222222222 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Terminal-Bench

Agent: ForgeCode · Verze: 2.0 · Měřeno: 2026-03-12

81,8 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Effort není doložen Úplná konfigurace běhu není ověřena

GPT-5.4

Model ve zdroji
gpt-5.4-2026-03-05_unknown
Záznam
terminalbench_external.csv: řádek 6
Původní hodnota
0.818 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 24 výsledků a konfigurací
Epoch · vlastní běh

GPQA Diamond

Effort: high · Měřeno: 2026-07-15

89,9 %
Pořadí ve zdrojovém snapshotu8. z 25 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
gpqa_diamond.csv: řádek 134
Původní hodnota
0.898989898989899 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: low · Měřeno: 2026-07-15

84,85 %
Pořadí ve zdrojovém snapshotu9. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_low
Záznam
gpqa_diamond.csv: řádek 135
Původní hodnota
0.8484848484848485 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: medium · Měřeno: 2026-07-15

88,89 %
Nejvyšší publikovaný výsledek1. z 12 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_medium
Záznam
gpqa_diamond.csv: řádek 132
Původní hodnota
0.8888888888888888 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: none · Měřeno: 2026-07-15

74,75 %
Pořadí ve zdrojovém snapshotu13. z 24 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_none
Záznam
gpqa_diamond.csv: řádek 133
Původní hodnota
0.7474747474747475 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: xhigh · Měřeno: 2026-03-06

93,3 %
Pořadí ve zdrojovém snapshotu4. z 11 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
gpqa_diamond.csv: řádek 163
Původní hodnota
0.933 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Humanity’s Last Exam

Effort: xhigh · Měřeno: datum neuvedeno

36,24 %
Malý vzorek — bez výkonové třídy2. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

gpt-5.4-2026-03-05 (xhigh thinking)

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
hle_external.csv: řádek 7
Původní hodnota
0.3624 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

ProofBench

Effort: xhigh · Měřeno: datum neuvedeno

56 %
Malý vzorek — bez výkonové třídy2. z 5 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

ProofBench v1.0-era value; model absent from the v1.1 board (vals.ai re-grade 2026-08-14, methodology changed) and not re-run. Not comparable to v1.1 rows. Annotated 2026-08-18.

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
proofbench_external.csv: řádek 14
Původní hodnota
0.56 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Měřeno: datum neuvedeno

34,9 %
Pořadí ve zdrojovém snapshotu9. z 35 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

GPT 5.4 [responses/gpt-5.4]

Model ve zdroji
gpt-5.4-2026-03-05_unknown
Záznam
apex_agents_external.csv: řádek 19
Původní hodnota
0.349 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Effort: xhigh · Měřeno: datum neuvedeno

36 %
Malý vzorek — bez výkonové třídy3. z 4 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

GPT 5.4 (xHigh)

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
apex_agents_external.csv: řádek 17
Původní hodnota
0.36 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

GSO

Effort: high · Měřeno: datum neuvedeno

25,49 %
Malý vzorek — bez výkonové třídy4. z 9 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_high
Záznam
gso_external.csv: řádek 14
Původní hodnota
0.2549 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

GSO

Effort: xhigh · Měřeno: datum neuvedeno

31,37 %
Malý vzorek — bez výkonové třídy2. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
gpt-5.4-2026-03-05_xhigh
Záznam
gso_external.csv: řádek 10
Původní hodnota
0.31370000000000003 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · 3d

Měřeno: datum neuvedeno

1 134 Elo
Střední pásmo64. z 98 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1134.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · asciiart

Měřeno: datum neuvedeno

1 221 Elo
Střední pásmo21. z 59 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1221.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

1 228 Elo
Střední pásmo40. z 106 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1228.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

1 251 Elo
Střední pásmo28. z 104 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1251.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 262 Elo
Střední pásmo27. z 105 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1262.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · svg

Měřeno: datum neuvedeno

1 222 Elo
Vysoký výkon19. z 74 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1222.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

1 258 Elo
Střední pásmo30. z 102 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1258.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

1 233 Elo
Střední pásmo41. z 112 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1233.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · androidnative

Měřeno: datum neuvedeno

1 047 Elo
Nižší výsledek34. z 35 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1047.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · fullstack

Měřeno: datum neuvedeno

1 024 Elo
Nižší výsledek35. z 39 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1024.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · godotgamedev

Měřeno: datum neuvedeno

1 135 Elo
Střední pásmo20. z 28 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1135.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · mobileapps

Měřeno: datum neuvedeno

1 123 Elo
Nižší výsledek35. z 37 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1123.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · webapps

Měřeno: datum neuvedeno

1 079 Elo
Nižší výsledek32. z 36 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/gpt-5.4
Záznam
openrouter.json
Původní hodnota
1079.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Vyšší cena32. z 309 modelů od nejdražšího

5,5 USD za srovnávací koš

6,88× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

GPT-5.4
NejdražšíVyšší cenaStředNízká cena

Nejbližší konkurenti podle ceny koše

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/gpt-5.4$2,5$15$0,25
↳ od 272 000 vstupních tokenů$5$22,5$0,5
Batchopenai/gpt-5.4:batch$1,25$7,5$0,125
↳ od 272 000 vstupních tokenů$2,5$11,25$0,25
Vstupní modality
text, image, file
Volání nástrojů
Ano
Do katalogu přidán
2026-03-05
Znalostní cutoff
Neuvedeno
Kanonická verze
openai/gpt-5.4-20260305
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

Hypata · 2026-04-09

Muse Spark: Meta se vrací do hry – ale do jaké? ↗

„Na Terminal-Bench 2.0 (agentní kódování v terminálu) dosahuje 59,0 – GPT-5.4 má 75,1, Gemini 68,5. Na GDPval-AA Elo (kancelářské úlohy v reálném prostředí) má 1 444 – Opus 4.6 dosahuje 1 606, GPT-5.4 má 1 672. Na SWE-Bench Pro (agentní kódování) 52,4 versus 57,7 u GPT-5.4. Na LiveCodeBench Pro (kompetitivní kódování) 80,0 versus 87,5 u GPT-5.4. Na GPQA Diamond (PhD-level reasoning) 89,5 versus 94,3 u Gemini.“
Patrick Zandl · 2026-04-07

GLM-5.1: open-source alternativa k Opusu ↗

„Terminal-Bench 2.0 je měřen dvěma různými harnesu: Z.ai reportuje GLM-5.1 na Claude Code harnesu (66,5 %), GPT-5.4 reportuje svůj výsledek na Codex harnesu (75,1 %). Přímé srovnání těchto čísel je pochybné.“

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.