Všechny modely

DeepSeek V4 Pro: model uvažování s 1M tokeny

Vlajkový model uvažování V4 od DeepSeek. V rámci 0,2 bodu od Claude Opus 4.6 na SWE-bench Verified za sedminu nákladů dodavatele. Claude-kompatibilní API.

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Pro je vlajková loď generace V4 od DeepSeek – MoE s otevřenou váhou 1,6T parametrů pod licencí MIT. Hlavní zprávou je poměr ceny a kvality: prodejcem hlášený SWE-bench Verified je 80,6 %, což je zlomek bodu od Claude Opus 4.6, za zhruba jednu sedminu nákladů prodejce Anthropic. To činí agenty náročné na uvažování – hromadné revize PR, dávkovou analýzu dokumentů, plánované shrnutí – cenově dostupné ve velkém objemu.

Ceníková cena prodejce je 1,74 $ / 3,48 $ za 1M tokenů s čtením z cache za 0,028 $ / 1M a bezplatným zápisem do cache (jedinečné v nabídce). Kontext 1M tokenů, Anthropic-kompatibilní API. Sáhněte po Sonnet 4.6, když je rozhodujícím faktorem spolehlivost směrování nástrojů v produkci, a po GPT-5.4 Mini nebo Kimi K2.7 Code, když jednorázová hromadná práce nepotřebuje hloubku uvažování V4 Pro.

Co je DeepSeek V4 Pro?

24. dubna 2026 · Varianta uvažování rodiny DeepSeek V4, zaměřená na maximální kvalitu uvažování.

DeepSeek V4 Pro je vlajková loď generace V4 od DeepSeek, vydaná 24. dubna 2026 pod licencí MIT. Jedná se o model Mixture-of-Experts s otevřenou váhou s celkovým počtem 1,6T parametrů a 49B aktivních na token.

V4 Pro podporuje kontextové okno 1M tokenů, maximální výstup 384K, tři režimy úsilí při uvažování (standardní, think, think-max), výstup JSON, volání nástrojů a dokončování FIM v režimu bez myšlení. Model Pro přidává hybridní architekturu pozornosti (Compressed Sparse Attention + Heavily Compressed Attention) pro dramaticky vylepšenou efektivitu dlouhého kontextu. 27 % FLOPů pro inferenci jednoho tokenu a 10 % KV cache oproti DeepSeek V3.2 při kontextu 1M.

Co je pozoruhodné na DeepSeek V4 Pro

Architektura nadpisů a funkce schopností.

V4 Pro je model Mixture-of-Experts s celkovým počtem 1,6T parametrů a 49B aktivních na token, s hybridním pozornostním zásobníkem (Compressed Sparse Attention plus Heavily Compressed Attention), který udržuje levnou inferenci s dlouhým kontextem. Podporuje kontextové okno 1M tokenů s maximálním výstupem 384K, tři režimy úsilí pro uvažování (standardní, myslet a myslet-max) a používá Manifold-Constrained Hyper-Connections pro stabilní šíření signálu. Model byl trénován na 32T+ tokenech s optimalizátorem Muon a je vydán pod licencí MIT s otevřenými váhami.

Specifikace na první pohled

RodinaŘada DeepSeek V4
ParametryCelkem 1,6T / 49B aktivních (MoE)
ModalitaText, kód
JazykyVícejazyčné
Kontextové okno1M tokenů
Maximální výstup384K tokenů
LicenceMIT (otevřené váhy)

Benchmarky DeepSeek V4 Pro

Výsledky hlášené dodavatelem z vydání DeepSeek V4 Pro. Nezávislé recenze (Geeky Gadgets, Code Arena) umisťují V4 Pro na třetí místo v Code Arena za GLM-5.1 a Kimi K2.7 Code. Nejsilnější tvrzení o benchmarku pocházejí z vlastních materiálů DeepSeek. Berte je spíše jako směrové než jako absolutní pravdu.

SWE-bench Verifiedhlášeno dodavatelem; v rozmezí 0,2 bodu od Opus 4.6
80.6%
Terminal-Bench 2.0hlášeno dodavatelem; vede Opus 4.6
67.9%
LiveCodeBenchnahlášeno dodavatelem
93.5%
Hodnocení Codeforcesnahlášeno dodavatelem
3206
MMLU-Pronahlášeno dodavatelem
Odpovídá GPT-5.4
Index umělé analytické inteligencemaximální úsilí
52
RychlostUmělá analýza
~36 tokenů/s

Ceny DeepSeek V4 Pro

Cena poskytovatele, za 1M tokenů.

Vstup$1.74
Výstup$3.48
Čtení z mezipaměti$0.14
Zápis do mezipamětiNení účtováno

Jak se DeepSeek V4 Pro chová v praxi

Pozorované chování z běhů produkčních agentů.

Odůvodnění

Nejsilnější uvažování sub-Sonnet v naší nabídce. Obstojí při vícestupňové práci, kde levnější modely začínají selhávat. Dodavatelem hlášené MMLU-Pro odpovídá GPT-5.4.

Kódovací benchmarky

Dodavatelem nahlášeno SWE-bench Verified 80,6 % (do 0,2 od Opus 4.6), Terminal-Bench 2.0 67,9 % (vede Opus 4.6), LiveCodeBench 93,5 %.

Nákladová efektivita

Vestavěná úroveň $ dělá z V4 Pro nákladově úspornou možnost uvažování, přičemž zůstává konkurenceschopná s Sonnet 4.6.

Rychlost

Přibližně 36 tokenů/s při maximálním úsilí podle Artificial Analysis. Pomalejší než Kimi K2.7 Code, mírně pomalejší než Opus 4.6.

Nejlepší úkoly agenta pro DeepSeek V4 Pro

Agent pro kontrolu PR, který běží při každém commitu

Přesnost na úrovni Sonnetu za zlomek nákladů dodavatele Sonnetu je to, co činí „revizi každého commitu, nejen velkých PR“ skutečně životaschopnou. V4 Pro čte rozdíl, související soubory a propojený problém, poté napíše strukturovaný komentář – a cena za volání je dostatečně nízká, že spuštění jako kroku CI při každém push se neprojeví jako znatelná položka.

Plánovaný sumarizátor, který běží každou noc

Stahuje včerejší zákaznické konverzace, tikety podpory nebo prodejní hovory a píše souhrn. Systémový prompt a schéma nástrojů se mezi spuštěními nemění a DeepSeek neúčtuje zápisy do cache – takže dlouhá pevná předpona je zaplacena jednou a čtení z cache stojí zlomek normálního vstupu. Zde model cen V4 Pro skutečně mění to, co je cenově dostupné.

Agent kódu pro celé úložiště, který stojí méně než Opus

Kontext s 1M tokeny s hybridní pozorností (Compressed Sparse Attention plus Heavily Compressed Attention) znamená, že středně velká kódová základna se vejde do jednoho promptu a náklady na inferenci zůstávají zvládnutelné, jak se okno zaplňuje. Pro refaktorování napříč soubory a revize na úrovni architektury je to místo, kde získáte pracovní postup ve stylu Opus „vidět vše najednou“ bez faktury ve stylu Opus.

Kdy přeskočit DeepSeek V4 Pro

Přeskočte V4 Pro u nejtěžších okrajových případů směrování nástrojů, kde stále vede Sonnet 4.6, a u hromadné jednorázové práce, kde postačuje GPT-5.4 Mini nebo Kimi K2.7 Code za nižší cenu.

DeepSeek V4 Pro vs. jiné modely

DeepSeek V4 Pro vs Claude Sonnet 4.6

Sonnet 4.6 zůstává spolehlivější volbou pro složité případy směrování nástrojů. V4 Pro stojí méně a je konkurenceschopný v benchmarkech kódování uváděných dodavateli. Před standardizací otestujte oba na skutečném agentovi.

Sečteno a podtrženo: měli byste používat DeepSeek V4 Pro?

Předfiltrujte pomocí GPT-5.4 Mini nebo Kimi K2.7 Code, eskalujte na V4 Pro pro uvažování, eskalujte na Sonnet 4.6 pouze tehdy, když se V4 Pro zasekne na okrajových případech směrování nástrojů.

Často kladené otázky

Kdy byl vydán DeepSeek V4 Pro?

DeepSeek vydal V4 Pro 24. dubna 2026 pod licencí MIT s otevřenými váhami.

Proč jsou zápisy do cache zdarma?

DeepSeek neúčtuje část za zápis do mezipaměti. Účtují se pouze čtení z mezipaměti, a to 0,145 $ za 1 milion tokenů. Stabilní systémové výzvy a velké referenční kontexty nestojí nic navíc za ukládání do mezipaměti.

Jaké je kontextové okno V4 Pro?

1 milion tokenů s výstupem až 384 tisíc tokenů. Hybridní architektura pozornosti umožňuje plné využití okna s mnohem nižšími náklady na inferenci než V3.2.

Jak se V4 Pro srovnává s Claude Opus 4.6?

Dodavatelem nahlášený SWE-bench Verified je v rozmezí 0,2 bodu (80,6 vs 80,8). Terminal-Bench 2.0 upřednostňuje V4 Pro (67,9 vs 65,4). Opus 4.6 vede na HLE (40,0 vs 37,7) a HMMT 2026 math (96,2 vs 95,2). Při ~7× nižších nákladech dodavatele je V4 Pro správnou volbou, když je kvalita uvažování prioritou, ale záleží na nákladech.

Používání DeepSeek V4 Pro na Okou

Dva způsoby přístupu k DeepSeek V4 Pro na Okou

Okou podporuje DeepSeek V4 Pro jako vestavěný model účtovaný v kreditech Okou a prostřednictvím vlastního přinesení s DeepSeek API key. Vestavěná cesta používá Okou Managed routing a cenovou úroveň vysvětlenou níže; cesta vlastního přinesení vám účtuje přímo u dodavatele a zcela přeskočí konverzi kreditů Okou.

Doporučení Okou

Okou umisťuje DeepSeek V4 Pro jako možnost úspory nákladů pro hromadnou klasifikaci, předfiltry, odpovědi citlivé na latenci a další vysoce objemovou práci.

Kredity a cenová úroveň $

Okou oceňuje každý vestavěný model na čtyřstupňové kreditní škále – $, $$, $$$, $$$$ – zobrazené jako odznak ve výběru modelu a na řádku price tier v zero model ls. DeepSeek V4 Pro se nachází na $. Tato úroveň je to, co utratíte ze svého kreditního zůstatku Okou; ceníková cena dodavatele v tabulce výše je to, co si účtuje upstream poskytovatel, než to Okou převede na kredity.

Dostupné na Okou od August 12, 2026.