DeepSeek V3 od DeepSeek nabízí kontext 163 840 tokenů. Popis v katalogu jej zaměřuje na programování. K dispozici jsou převzaté výsledky programovacích testů; jednotlivé běhy a jejich podmínky najdete níže.
NástrojeHF repozitář
Vstup / 1M tokenů$0,32
Výstup / 1M tokenů$0,89
Kontext163,8 k
Čeština
Zatím bez vlastního měření. Obecný jazykový benchmark nepovažujeme za test češtiny.
Popis z OpenRouteru v původním znění
DeepSeek-V3 is the latest model from the DeepSeek team, building upon the instruction following and coding abilities of the previous versions. Pre-trained on nearly 15 trillion tokens, the reported evaluations...
AA Coding Index v katalogu chybí. Jednotlivé testy níže hodnotíme samostatně, bez odhadu celkového výkonu.
Publikované výsledky, nikoli vlastní měření. Každý záznam zachovává svou konfiguraci. Neúplně popsané běhy nezakládají pořadí kvality.
Všechny dostupné výsledky; pořadí je pouze ze zdrojového snapshotu, pokud je uvedeno.
Benchmark
Výsledek
Pořadí
Nápověda
Aider PolyglotDeepSeek-V3
48,4 %
13/20
ⓘ
Kódové úlohy v několika programovacích jazycích řešené nástrojem Aider. Není to test přirozených jazyků; záleží na nastavení editace a pokusech.
SciCodeDeepSeek-V3
35,42 %
35/44
ⓘ
Tvorba kódu pro vědecké výzkumné problémy. Úzká oblast; konkrétní měření AA a obecná definice datasetu mají oddělený původ.
GPQA DiamondDeepSeek-V3
56,53 %
56/69
ⓘ
Výsledky znalostního benchmarku GPQA; nejde o programovací úlohy. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · 3ddeepseek/deepseek-chat
1 119 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · datavizdeepseek/deepseek-chat
1 105 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · gamedevdeepseek/deepseek-chat
1 077 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · svgdeepseek/deepseek-chat
1 004 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · uicomponentdeepseek/deepseek-chat
1 112 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Design Arena · websitedeepseek/deepseek-chat
1 133 Elo
—
ⓘ
Hodnocení designu vytvořeného AI komunitou; oddělujeme jednotlivé kategorie. Konkrétní verze, kategorie a protokol musí být přiřazeny k výsledku; obecný popis necertifikuje srovnání.
Epoch · převzatý běh
Aider Polyglot
Měřeno: datum neuvedeno
48,4 %
Pořadí ve zdrojovém snapshotu13. z 20 modelůPořadí všech dostupných řádků ve zdrojovém snapshotu. Bez tvrzení o statisticky průkazném vedení.
Podmínky a zdroj výsledku
Datum měření není uvedeno Verze testu není v exportu jednoznačná Effort není doložen Úplná konfigurace běhu není ověřena
100 požadavků, každý s 10 000 vstupními tokeny. Výstup podle zvoleného poměru. Základní textové API včetně případného poplatku za požadavek; nejde o cenu úspěšně vyřešené úlohy.
Co za své peníze získáte jinde
Blízký index = rozdíl nejvýše 3 body. Podobná cena = ±20 % koše. Pokud blízký index levněji chybí, ukazujeme nejbližší nižší index s úsporou. Výběr z celého katalogu; jde o publikovaný AA index s neúplnou metodikou.
Pro tento koš nemáme alternativu splňující cenové a indexové podmínky. Chybějící doporučení nedoplňujeme odhadem.
USD za milion tokenů. Nabídky a pásma z OpenRouteru; ceny předplatného aplikací zde nejsou.
Blízkost výstupní ceny, publikovaného AA Coding Indexu (kde je) a zaměření v popisu. Kandidáti z aktuálního katalogu se stejnými výstupními modalitami; nejde o pořadí kvality. Cenové rozdíly níže platí pro základní standardní API sazbu.
K tomuto modelu zatím nemáme spárovanou redakční analýzu. Karta vznikla nezávisle na článcích.
Charakteristika vznikla automaticky z parametrů a popisu OpenRouteru. Benchmarky jsou převzaté výsledky s uvedenými zdroji; redakční zkušenosti jsou oddělené v analýzách.