DeepSeek V4 Pro: model uvažování s 1M tokeny
Vlajkový model uvažování V4 od DeepSeek. V rámci 0,2 bodu od Claude Opus 4.6 na SWE-bench Verified za sedminu nákladů dodavatele. Claude-kompatibilní API.
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Pro je vlajková loď generace V4 od DeepSeek – MoE s otevřenou váhou 1,6T parametrů pod licencí MIT. Hlavní zprávou je poměr ceny a kvality: prodejcem hlášený SWE-bench Verified je 80,6 %, což je zlomek bodu od Claude Opus 4.6, za zhruba jednu sedminu nákladů prodejce Anthropic. To činí agenty náročné na uvažování – hromadné revize PR, dávkovou analýzu dokumentů, plánované shrnutí – cenově dostupné ve velkém objemu.
Ceníková cena prodejce je 1,74 $ / 3,48 $ za 1M tokenů s čtením z cache za 0,028 $ / 1M a bezplatným zápisem do cache (jedinečné v nabídce). Kontext 1M tokenů, Anthropic-kompatibilní API. Sáhněte po Sonnet 4.6, když je rozhodujícím faktorem spolehlivost směrování nástrojů v produkci, a po GPT-5.4 Mini nebo Kimi K2.7 Code, když jednorázová hromadná práce nepotřebuje hloubku uvažování V4 Pro.
Co je DeepSeek V4 Pro?
24. dubna 2026 · Varianta uvažování rodiny DeepSeek V4, zaměřená na maximální kvalitu uvažování.
DeepSeek V4 Pro je vlajková loď generace V4 od DeepSeek, vydaná 24. dubna 2026 pod licencí MIT. Jedná se o model Mixture-of-Experts s otevřenou váhou s celkovým počtem 1,6T parametrů a 49B aktivních na token.
V4 Pro podporuje kontextové okno 1M tokenů, maximální výstup 384K, tři režimy úsilí při uvažování (standardní, think, think-max), výstup JSON, volání nástrojů a dokončování FIM v režimu bez myšlení. Model Pro přidává hybridní architekturu pozornosti (Compressed Sparse Attention + Heavily Compressed Attention) pro dramaticky vylepšenou efektivitu dlouhého kontextu. 27 % FLOPů pro inferenci jednoho tokenu a 10 % KV cache oproti DeepSeek V3.2 při kontextu 1M.
Co je pozoruhodné na DeepSeek V4 Pro
Architektura nadpisů a funkce schopností.
V4 Pro je model Mixture-of-Experts s celkovým počtem 1,6T parametrů a 49B aktivních na token, s hybridním pozornostním zásobníkem (Compressed Sparse Attention plus Heavily Compressed Attention), který udržuje levnou inferenci s dlouhým kontextem. Podporuje kontextové okno 1M tokenů s maximálním výstupem 384K, tři režimy úsilí pro uvažování (standardní, myslet a myslet-max) a používá Manifold-Constrained Hyper-Connections pro stabilní šíření signálu. Model byl trénován na 32T+ tokenech s optimalizátorem Muon a je vydán pod licencí MIT s otevřenými váhami.
Specifikace na první pohled
Benchmarky DeepSeek V4 Pro
Výsledky hlášené dodavatelem z vydání DeepSeek V4 Pro. Nezávislé recenze (Geeky Gadgets, Code Arena) umisťují V4 Pro na třetí místo v Code Arena za GLM-5.1 a Kimi K2.7 Code. Nejsilnější tvrzení o benchmarku pocházejí z vlastních materiálů DeepSeek. Berte je spíše jako směrové než jako absolutní pravdu.
Ceny DeepSeek V4 Pro
Cena poskytovatele, za 1M tokenů.
Jak se DeepSeek V4 Pro chová v praxi
Pozorované chování z běhů produkčních agentů.
Odůvodnění
Nejsilnější uvažování sub-Sonnet v naší nabídce. Obstojí při vícestupňové práci, kde levnější modely začínají selhávat. Dodavatelem hlášené MMLU-Pro odpovídá GPT-5.4.
Kódovací benchmarky
Dodavatelem nahlášeno SWE-bench Verified 80,6 % (do 0,2 od Opus 4.6), Terminal-Bench 2.0 67,9 % (vede Opus 4.6), LiveCodeBench 93,5 %.
Nákladová efektivita
Vestavěná úroveň $ dělá z V4 Pro nákladově úspornou možnost uvažování, přičemž zůstává konkurenceschopná s Sonnet 4.6.
Rychlost
Přibližně 36 tokenů/s při maximálním úsilí podle Artificial Analysis. Pomalejší než Kimi K2.7 Code, mírně pomalejší než Opus 4.6.
Nejlepší úkoly agenta pro DeepSeek V4 Pro
Agent pro kontrolu PR, který běží při každém commitu
Přesnost na úrovni Sonnetu za zlomek nákladů dodavatele Sonnetu je to, co činí „revizi každého commitu, nejen velkých PR“ skutečně životaschopnou. V4 Pro čte rozdíl, související soubory a propojený problém, poté napíše strukturovaný komentář – a cena za volání je dostatečně nízká, že spuštění jako kroku CI při každém push se neprojeví jako znatelná položka.
Plánovaný sumarizátor, který běží každou noc
Stahuje včerejší zákaznické konverzace, tikety podpory nebo prodejní hovory a píše souhrn. Systémový prompt a schéma nástrojů se mezi spuštěními nemění a DeepSeek neúčtuje zápisy do cache – takže dlouhá pevná předpona je zaplacena jednou a čtení z cache stojí zlomek normálního vstupu. Zde model cen V4 Pro skutečně mění to, co je cenově dostupné.
Agent kódu pro celé úložiště, který stojí méně než Opus
Kontext s 1M tokeny s hybridní pozorností (Compressed Sparse Attention plus Heavily Compressed Attention) znamená, že středně velká kódová základna se vejde do jednoho promptu a náklady na inferenci zůstávají zvládnutelné, jak se okno zaplňuje. Pro refaktorování napříč soubory a revize na úrovni architektury je to místo, kde získáte pracovní postup ve stylu Opus „vidět vše najednou“ bez faktury ve stylu Opus.
Kdy přeskočit DeepSeek V4 Pro
Přeskočte V4 Pro u nejtěžších okrajových případů směrování nástrojů, kde stále vede Sonnet 4.6, a u hromadné jednorázové práce, kde postačuje GPT-5.4 Mini nebo Kimi K2.7 Code za nižší cenu.
DeepSeek V4 Pro vs. jiné modely
DeepSeek V4 Pro vs Claude Sonnet 4.6
Sonnet 4.6 zůstává spolehlivější volbou pro složité případy směrování nástrojů. V4 Pro stojí méně a je konkurenceschopný v benchmarkech kódování uváděných dodavateli. Před standardizací otestujte oba na skutečném agentovi.
Sečteno a podtrženo: měli byste používat DeepSeek V4 Pro?
Předfiltrujte pomocí GPT-5.4 Mini nebo Kimi K2.7 Code, eskalujte na V4 Pro pro uvažování, eskalujte na Sonnet 4.6 pouze tehdy, když se V4 Pro zasekne na okrajových případech směrování nástrojů.
Často kladené otázky
Kdy byl vydán DeepSeek V4 Pro?
DeepSeek vydal V4 Pro 24. dubna 2026 pod licencí MIT s otevřenými váhami.
Proč jsou zápisy do cache zdarma?
DeepSeek neúčtuje část za zápis do mezipaměti. Účtují se pouze čtení z mezipaměti, a to 0,145 $ za 1 milion tokenů. Stabilní systémové výzvy a velké referenční kontexty nestojí nic navíc za ukládání do mezipaměti.
Jaké je kontextové okno V4 Pro?
1 milion tokenů s výstupem až 384 tisíc tokenů. Hybridní architektura pozornosti umožňuje plné využití okna s mnohem nižšími náklady na inferenci než V3.2.
Jak se V4 Pro srovnává s Claude Opus 4.6?
Dodavatelem nahlášený SWE-bench Verified je v rozmezí 0,2 bodu (80,6 vs 80,8). Terminal-Bench 2.0 upřednostňuje V4 Pro (67,9 vs 65,4). Opus 4.6 vede na HLE (40,0 vs 37,7) a HMMT 2026 math (96,2 vs 95,2). Při ~7× nižších nákladech dodavatele je V4 Pro správnou volbou, když je kvalita uvažování prioritou, ale záleží na nákladech.
Používání DeepSeek V4 Pro na Okou
Dva způsoby přístupu k DeepSeek V4 Pro na Okou
Okou podporuje DeepSeek V4 Pro jako vestavěný model účtovaný v kreditech Okou a prostřednictvím vlastního přinesení s DeepSeek API key. Vestavěná cesta používá Okou Managed routing a cenovou úroveň vysvětlenou níže; cesta vlastního přinesení vám účtuje přímo u dodavatele a zcela přeskočí konverzi kreditů Okou.
Doporučení Okou
Okou umisťuje DeepSeek V4 Pro jako možnost úspory nákladů pro hromadnou klasifikaci, předfiltry, odpovědi citlivé na latenci a další vysoce objemovou práci.
Kredity a cenová úroveň $
Okou oceňuje každý vestavěný model na čtyřstupňové kreditní škále – $, $$, $$$, $$$$ – zobrazené jako odznak ve výběru modelu a na řádku price tier v zero model ls. DeepSeek V4 Pro se nachází na $. Tato úroveň je to, co utratíte ze svého kreditního zůstatku Okou; ceníková cena dodavatele v tabulce výše je to, co si účtuje upstream poskytovatel, než to Okou převede na kredity.
Dostupné na Okou od August 12, 2026.

