GPT-4.1 od OpenAI nabízí kontext 1 047 576 tokenů. Popis v katalogu jej zaměřuje na programování, analytické úlohy. K dispozici jsou převzaté výsledky programovacích testů; jednotlivé běhy a jejich podmínky najdete níže.
Obrazový vstupNástroje
Vstup / 1M tokenů$2
Výstup / 1M tokenů$8
Kontext1,05 M
Čeština
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Popis z OpenRouteru v původním znění
GPT-4.1 is a flagship large language model optimized for advanced instruction following, real-world software engineering, and long-context reasoning. It supports a 1 million token context window and outperforms GPT-4o and...
AA Coding Index v katalogu chybí. Jednotlivé testy níže hodnotíme samostatně, bez odhadu celkového výkonu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
Benchmark
Výsledek
Pořadí
Nápověda
Aider Polyglotgpt-4.1-2025-04-14
52,4 %
12/20
ⓘ
Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.
SWE-bench Verifiedgpt-4.1-2025-04-14
48,54 %
15/15
ⓘ
Řešení reálných softwarových problémů změnou kódu repozitáře. Výsledek závisí na agentu, sadě úloh a konfiguraci.
GPQA Diamondgpt-4.1-2025-04-14
66,92 %
47/69
ⓘ
Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Humanity’s Last Examgpt-4.1-2025-04-14
5,4 %
23/24
ⓘ
Znalostní test; revize a změny otázek je potřeba vztáhnout ke konkrétnímu měření. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · 3dopenai/gpt-4.1
882 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · codecategoriesopenai/gpt-4.1
1 042 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · datavizopenai/gpt-4.1
1 119 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · gamedevopenai/gpt-4.1
1 103 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · uicomponentopenai/gpt-4.1
1 018 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · websiteopenai/gpt-4.1
1 052 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Epoch · převzatý běh
Aider Polyglot
Měřeno: 2025-04-14
52,4 %
Pořadí ve zdrojovém snapshotu12. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku
Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Co za své peníze získáte jinde
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Pro tento koš nemáme alternativu splňující cenové a indexové podmínky. Chybějící doporučení nedoplňujeme odhadem.
USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.