o4 Mini od OpenAI nabízí kontext 200 000 tokenů. Popis v katalogu jej zaměřuje na práce s nástroji a agenty, analytické úlohy, práce s obrazovým vstupem. K dispozici jsou převzaté výsledky programovacích testů; jednotlivé běhy a jejich podmínky najdete níže.
Obrazový vstupNástroje
Vstup / 1M tokenů$1,1
Výstup / 1M tokenů$4,4
Kontext200 k
Čeština
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Popis z OpenRouteru v původním znění
OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient performance while retaining strong multimodal and agentic capabilities. It supports tool use and demonstrates competitive reasoning...
AA Coding Index v katalogu chybí. Jednotlivé testy níže hodnotíme samostatně, bez odhadu celkového výkonu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
Benchmark
Výsledek
Pořadí
Nápověda
Aider Polygloto4-mini-2025-04-16_high
72 %
4/8
ⓘ
Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.
GPQA Diamondo4-mini-2025-04-16_high
79,61 %
18/25
ⓘ
Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
GPQA Diamondo4-mini-2025-04-16_low
75,25 %
16/22
ⓘ
Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
GPQA Diamondo4-mini-2025-04-16_medium
77,78 %
7/12
ⓘ
Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Humanity’s Last Examo4-mini-2025-04-16_high
18,08 %
3/3
ⓘ
Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Humanity’s Last Examo4-mini-2025-04-16_medium
14,28 %
2/2
ⓘ
Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
GSOo4-mini-2025-04-16_high
3,6 %
8/9
ⓘ
Význam benchmarku není v registru popsán. Podmínky zdroje je třeba ověřit u konkrétního běhu.
Design Arena · 3dopenai/o4-mini
886 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · codecategoriesopenai/o4-mini
992 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · datavizopenai/o4-mini
1 006 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · gamedevopenai/o4-mini
1 026 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · uicomponentopenai/o4-mini
1 002 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · websiteopenai/o4-mini
998 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Epoch · převzatý běh
Aider Polyglot
Effort: high · Měřeno: 2025-04-16
72 %
Malý vzorek — bez výkonové třídy4. z 8 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku
Verze testu není v exportu jednoznačná Úplná konfigurace běhu není ověřena
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Co za své peníze získáte jinde
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Pro tento koš nemáme alternativu splňující cenové a indexové podmínky. Chybějící doporučení nedoplňujeme odhadem.
USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.