Vibecoding.cz Patrick Zandl o AI vývoji
Reklama
V nabídce OpenRouteru · OpenAI

o3

openai/o3

Porovnat model ↗

o3 od OpenAI nabízí kontext 200 000 tokenů. Popis v katalogu jej zaměřuje na programování, analytické úlohy, práce s obrazovým vstupem. K dispozici jsou převzaté výsledky programovacích testů; jednotlivé běhy a jejich podmínky najdete níže.

Obrazový vstupNástroje
Vstup / 1M tokenů$2
Výstup / 1M tokenů$8
Kontext200 k
Čeština

Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.

Popis z OpenRouteru v původním znění

o3 is a well-rounded and powerful model across domains. It sets a new standard for math, science, coding, and visual reasoning tasks. It also excels at technical writing and instruction-following....

OpenRouter ↗

Co ukazují výsledky

VÝKONOVÉ ZAŘAZENÍ

Zatím bez společného ukazatele

AA Coding Index v katalogu chybí. Jednotlivé testy níže hodnotíme samostatně, bez odhadu celkového výkonu.

Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.

Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
BenchmarkVýsledekPořadíNápověda
Aider Polygloto3-2025-04-16_high81,3 %3/8

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

Aider Polygloto3-2025-04-16_medium76,9 %2/3

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

Aider Polygloto3-2025-04-16_unknown76,9 %1/20

Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.

SWE-bench Verifiedo3-2025-04-16_medium62,32 %3/3

Řešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci.

GPQA Diamondo3-2025-04-16_high81,82 %16/25

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondo3-2025-04-16_low79,8 %13/22

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

GPQA Diamondo3-2025-04-16_medium80,81 %6/12

Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Humanity’s Last Examo3-2025-04-16_high20,32 %2/3

Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Humanity’s Last Examo3-2025-04-16_medium19,2 %1/2

Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

APEX Agentso3-2025-04-16_high17,2 %6/7

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

GSOo3-2025-04-16_high8,8 %6/9

Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.

Design Arena · codecategoriesopenai/o31 036 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · datavizopenai/o31 200 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · gamedevopenai/o31 058 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · uicomponentopenai/o31 035 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Design Arena · websiteopenai/o31 049 Elo

Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.

Epoch · převzatý běh

Aider Polyglot

Effort: high · Měřeno: 2025-06-25

81,3 %
Malý vzorek — bez výkonové třídy3. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_high
Záznam
aider_polyglot_external.csv: řádek 38
Původní hodnota
81.3
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Effort: medium · Měřeno: datum neuvedeno

76,9 %
Malý vzorek — bez výkonové třídy2. z 3 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_medium
Záznam
aider_polyglot_external.csv: řádek 10
Původní hodnota
76.9
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Aider Polyglot

Měřeno: 2025-06-25

76,9 %
Nejvyšší publikovaný výsledek1. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_unknown
Záznam
aider_polyglot_external.csv: řádek 73
Původní hodnota
76.9
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

SWE-bench Verified

Effort: medium · Měřeno: 2026-02-12

62,32 %
Malý vzorek — bez výkonové třídy3. z 3 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_medium
Záznam
swe_bench_verified.csv: řádek 25
Původní hodnota
0.6231884057971014 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: high · Měřeno: 2025-04-16

81,82 %
Pořadí ve zdrojovém snapshotu16. z 25 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_high
Záznam
gpqa_diamond.csv: řádek 220
Původní hodnota
0.8181818181818182 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · vlastní běh

GPQA Diamond

Effort: low · Měřeno: 2026-07-15

79,8 %
Pořadí ve zdrojovém snapshotu13. z 22 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_low
Záznam
gpqa_diamond.csv: řádek 131
Původní hodnota
0.797979797979798 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Dalších 10 výsledků a konfigurací
Epoch · vlastní běh

GPQA Diamond

Effort: medium · Měřeno: 2026-08-07

80,81 %
Pořadí ve zdrojovém snapshotu6. z 12 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_medium
Záznam
gpqa_diamond.csv: řádek 68
Původní hodnota
0.8080808080808081 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Humanity’s Last Exam

Effort: high · Měřeno: datum neuvedeno

20,32 %
Malý vzorek — bez výkonové třídy2. z 3 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

o3 (high) (April 2025)

Model ve zdroji
o3-2025-04-16_high
Záznam
hle_external.csv: řádek 18
Původní hodnota
0.20320000000000002 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

Humanity’s Last Exam

Effort: medium · Měřeno: datum neuvedeno

19,2 %
Malý vzorek — bez výkonové třídy1. z 2 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

o3 (medium) (April 2025)

Model ve zdroji
o3-2025-04-16_medium
Záznam
hle_external.csv: řádek 20
Původní hodnota
0.192 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

APEX Agents

Effort: high · Měřeno: datum neuvedeno

17,2 %
Malý vzorek — bez výkonové třídy6. z 7 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

o3

Model ve zdroji
o3-2025-04-16_high
Záznam
apex_agents_external.csv: řádek 44
Původní hodnota
0.172 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Epoch · převzatý běh

GSO

Effort: high · Měřeno: datum neuvedeno

8,8 %
Malý vzorek — bez výkonové třídy6. z 9 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Datum měření není uvedeno Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena

Model ve zdroji
o3-2025-04-16_high
Záznam
gso_external.csv: řádek 22
Původní hodnota
0.088 · převod × 100
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · codecategories

Měřeno: datum neuvedeno

1 036 Elo
Nižší výsledek93. z 106 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/o3
Záznam
openrouter.json
Původní hodnota
1036.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · dataviz

Měřeno: datum neuvedeno

1 200 Elo
Střední pásmo48. z 104 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/o3
Záznam
openrouter.json
Původní hodnota
1200.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · gamedev

Měřeno: datum neuvedeno

1 058 Elo
Nižší výsledek87. z 105 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/o3
Záznam
openrouter.json
Původní hodnota
1058.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · uicomponent

Měřeno: datum neuvedeno

1 035 Elo
Nižší výsledek87. z 102 modelů · sdílené pořadíPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/o3
Záznam
openrouter.json
Původní hodnota
1035.0
Původní zdroj ↗ · Zdroj převzetí ↗
Design Arena přes OpenRouter

Design Arena · website

Měřeno: datum neuvedeno

1 049 Elo
Nižší výsledek95. z 112 modelůPořadí publikovaných hodnot. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku

Elo preferencí designu; není obecným skóre programování. Datum měření a velikost vzorku API neuvádí.

Model ve zdroji
openai/o3
Záznam
openrouter.json
Původní hodnota
1049.0
Původní zdroj ↗ · Zdroj převzetí ↗

Kolik stojí používání

Vyšší cena55. z 309 modelů · sdílené pořadí od nejdražšího

3,6 USD za srovnávací koš

4,5× medián · medián 0,8 USD. Srovnání 309 modelů celého katalogu s použitelnou standardní API sazbou a dostatečným kontextem.

o3
NejdražšíVyšší cenaStředNízká cena

100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.

Co za své peníze získáte jinde

Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.

Pro tento koš nemáme alternativu splňující cenové a indexové podmínky. Chybějící doporučení nedoplňujeme odhadem.

USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.

NabídkaTokenové sazbyČtení cache
Standardní APIopenai/o3$2$8$0,5
Batchopenai/o3:batch$1$4$0,25
Vstupní modality
image, text, file
Volání nástrojů
Ano
Do katalogu přidán
2025-04-16
Znalostní cutoff
2024-06-30
Kanonická verze
openai/o3-2025-04-16
Otevřít nabídku na OpenRouteru ↗

Co zvážit vedle tohoto modelu

Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.

Další modely od OpenAI

Co jsme o modelu napsali

K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.

Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.