DeepSeek V4 Flash na Okou. Kódování na úrovni agenta za nejlevnější cenu
DeepSeekův open-weight 284B Mixture-of-Experts model s 13B aktivními na token. Sestavení 0731 překonává V4 Pro ve všech agentních benchmarcích, které DeepSeek zveřejnil, za 0,14 $ / 0,28 $ za 1M tokenů.
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash je efektivní polovina generace V4 od DeepSeek: model Mixture-of-Experts s 284B parametry, který aktivuje 13B parametrů na token, vydaný pod licencí MIT s otevřenými váhami. Sestavení 0731, které bylo dodáno 31. července 2026, zachovalo architekturu beze změny a znovu spustilo post-trénink na datech agentů, což ho posunulo za DeepSeek V4 Pro (Preview) na všech devíti benchmarcích agentů, které DeepSeek publikoval – 82,7 proti 72,1 na Terminal-Bench 2.1 a 54,4 proti 12,8 na DeepSWE.
Ceníková cena prodejce je 0,14 $ / 0,28 $ za 1M tokenů, s cache hity za 0,0028 $ / 1M a bez poplatku za zápisy do cache, což z něj činí nejlevnější model pro uvažování v současné nabídce Okou. Má kontextové okno 1M tokenů, až 384K výstupu a režim myšlení je ve výchozím nastavení zapnutý. Je pouze textový: bez vize. Sáhněte po Claude Sonnet 4.6, když krok vyžaduje obrázky nebo framework Claude Code, a po GPT 5.6 Luna, když chcete levnější úroveň rodiny OpenAI.
Co je DeepSeek V4 Flash?
31. července 2026 (DeepSeek-V4-Flash-0731, veřejná beta) · Úspornější polovina rodiny DeepSeek V4: 13B aktivních parametrů oproti 49B u V4 Pro, dodatečně trénovaná pro práci agentů.
DeepSeek V4 Flash se poprvé objevil 24. dubna 2026 jako menší polovina rodiny V4 – MoE s 284B parametry s 13B aktivními na token a kontextovým oknem 1M tokenů, vedle V4 Pro s 1.6T parametry. Z předběžné verze vyšel 31. července 2026 jako DeepSeek-V4-Flash-0731, veřejná beta verze, která zachovala architekturu nedotčenou a znovu spustila pouze post-tréninkový průchod, tentokrát na datech s agentním zaměřením.
Toto přeškolení je celým příběhem vydání. Podle vlastních čísel DeepSeeku překonává sestavení 0731 V4 Pro (Preview) ve všech devíti publikovaných benchmarkech agentů, přičemž aktivuje zhruba čtvrtinu parametrů: Terminal-Bench 2.1 jde z 61.8 v Flash preview na 82.7, DeepSWE ze 7.3 na 54.4, Toolathlon-Verified ze 49.7 na 70.3. Několik z nich se pohybuje v řádu několika bodů od Claude Opus 4.8 – 82.7 proti 85.0 na Terminal-Bench 2.1, 25.2 proti 25.7 na Agents' Last Exam – za zlomek ceny.
Je třeba jasně uvést výhrady. Každé skóre je hlášeno společností DeepSeek a spuštěno s DeepSeek Harness, který nebyl vydán, takže nic z toho nebylo nezávisle reprodukováno a dvě z devíti sad jsou interní sady DeepSeeku. Model je pouze textový, zaostává za špičkou v uvažování na úrovni absolventů a stále zaostává za V4 Pro v dlouhodobých vícestupňových úkolech. Režim myšlení je standardně zapnutý a tokeny myšlení se účtují jako výstup.
Co je pozoruhodné na DeepSeek V4 Flash
Architektura nadpisů a funkce schopností.
V4 Flash je řídký model Mixture-of-Experts: celkem 284B parametrů s 13B aktivovanými na token, kde každá vrstva MoE obsahuje 1 sdíleného experta a 256 směrovaných expertů s mezilehlou dimenzí 2048, a 6 směrovaných expertů se spouští na token. První tři vrstvy MoE používají hashové směrování a hloubka predikce více tokenů je 1. Publikovaný kontrolní bod 0731 má 304B parametrů, protože obsahuje modul pro spekulativní dekódování nad základem 284B. Podporuje kontextové okno 1M tokenů s až 384K výstupu, režimy myšlení a nemyšlení a parametr reasoning_effort s úrovněmi low, high a max. Váhy jsou licencovány pod MIT a jsou neomezené.
Specifikace na první pohled
Benchmarky DeepSeek V4 Flash
DeepSeek-hlášené údaje z karty modelu DeepSeek-V4-Flash-0731, spuštěné s DeepSeek Harness v minimálním režimu s maximálním úsilím o uvažování (teplota 1.0, top_p 0.95). Harness nebyl vydán, takže žádný z těchto údajů nebyl nezávisle reprodukován a DSBench-FullStack a DSBench-Hard jsou interní testovací sady DeepSeek.
Ceny DeepSeek V4 Flash
Cena poskytovatele, za 1M tokenů.
Jak se DeepSeek V4 Flash chová v praxi
Pozorované chování z běhů produkčních agentů.
Agentní provedení
Cíle po tréninku 0731 se zaměřují přesně na toto: řízení terminálu, sekvenční volání nástrojů a dokončení úkolu bez lidského zásahu. 82.7 na Terminal-Bench 2.1 a 70.3 na Toolathlon-Verified ho řadí mezi špičku za danou cenu.
Nákladový profil
0,14 $ / 0,28 $ za 1M tokenů, zásahy do cache za 0,0028 $ / 1M a zápisy do cache se neúčtují vůbec. To je nejlevnější pozice v současné nabídce a zhruba třetina výstupní ceny V4 Pro, takže je to model pro práci s vysokým objemem.
Dlouhý kontext
1M tokenů dovnitř a až 384K ven, takže čtení celého úložiště a dlouhé přepisy se vejdou bez rozdělování. Kvalita u dlouhodobých, vícestupňových agentních smyček stále zaostává za V4 Pro.
Hloubka uvažování
Tři úrovně reasoning_effort – low, high a max – vyměňují latenci za rozvahu a publikovaná skóre DeepSeek jsou všechna na max. Uvažování na úrovni absolventů není jeho silnou stránkou; tam zůstávají Claude Opus 5 a GPT 5.6 Sol napřed.
Modalita
Pouze text a kód. Cokoli se snímkem obrazovky, naskenovaným PDF nebo grafem ve smyčce vyžaduje vizuální model, jako je Claude Sonnet 4.6 nebo GPT 5.6 Luna.
Nejlepší úkoly agenta pro DeepSeek V4 Flash
Agenti pro kódování s vysokým objemem
Hromadné revize PR, psaní testů, lint-and-fix průchody a plánované refaktoringy, kde stejný agent běží stokrát denně. Při 0,28 $ za 1M výstupních tokenů zůstávají náklady na jedno spuštění dostatečně nízké, takže objem přestává být omezením.
Automatizace řízená terminálem a nástroji
Nejsilnější publikované výsledky sestavení 0731 jsou v terminálové práci a používání nástrojů, což je přesně to, co agent pro opravu sestavení, kontrolu nasazení nebo třídění protokolů dělá celý den.
Čtení celého úložiště
Okno 1M tokenů pojme celý středně velký repozitář, dlouhou časovou osu incidentu nebo kompletní sadu návrhových dokumentů v jednom průchodu, takže migrační nebo auditní agent může uvažovat o celé věci namísto po částech.
Levná vrstva pod hraničním orchestrátorem
Nechte Claude Opus 5 nebo GPT 5.6 Sol plánovat a revidovat a mnoho mechanických kroků – čtení souborů, spouštění příkazů, navrhování záplat – předejte V4 Flash. Hraniční sazbu platíte pouze za kroky, které rozhodují o běhu.
Kdy přeskočit DeepSeek V4 Flash
V4 Flash přeskočte u všeho, co obsahuje obrázky ve smyčce, protože nemá vizi, a u uvažování na úrovni absolventů, kde jsou hraniční modely stále jasně napřed. Dlouhodobé běhy, které zůstávají koherentní po mnoho hodin, zůstávají doménou V4 Pro a Claude Opus. A zveřejněné skóre agentů považujte za tvrzení dodavatele, dokud nebude dodán DeepSeek Harness: otestujte je na svém vlastním úložišti, než přesunete produkčního agenta.
DeepSeek V4 Flash vs. jiné modely
DeepSeek V4 Flash vs DeepSeek V4 Pro
Stejná rodina, opačný kompromis. Pro je vlajková loď s 1,6T a 49B aktivními na token; Flash aktivuje 13B a je uveden za třetinu ceny výstupu Pro. Na publikovaných agentních benchmarcích DeepSeeku nyní 0731 Flash build dosahuje vyšších skóre než V4 Pro (Preview) ve všech devíti, takže argumentem pro Pro je hloubka v dlouhém vícestupňovém uvažování spíše než propustnost agenta. V4 Pro již není nabízen na Okou – jeho stránka zde je referenční materiál.
DeepSeek V4 Flash vs GPT 5.6 Luna
Oba jsou levnou úrovní své rodiny a oba běží na frameworku Codex. Luna je multimodální a podporovaná ekosystémem OpenAI; Flash je pouze textový, s otevřenou váhou, stojí méně než čtvrtinu ceny výstupu Luny a vykazuje mnohem silnější publikované výsledky benchmarků agentů. Vyberte Lunu, když potřebujete vizi nebo chování specifické pro OpenAI, Flash, když je práce kód a nástroje.
DeepSeek V4 Flash vs Claude Sonnet 4.6
Sonnet 4.6 je základní model agenta s vizí, frameworkem Claude Code a spolehlivostí směrování nástrojů Anthropic; Flash je cenově úsporný, pouze textový model za zhruba padesátinu výstupní ceny Sonnetu. Ponechte Sonnet na krocích, které rozhodují o spuštění, a dejte Flashu objem pod ním.
Sečteno a podtrženo: měli byste používat DeepSeek V4 Flash?
DeepSeek V4 Flash je nejlevnější způsob, jak spustit kompetentního kódovacího agenta na Okou: hraniční agentní benchmarky, okno 1M tokenů a 0,28 $ za 1M výstupních tokenů. Ověřte si čísla dodavatele na svém vlastním úložišti, ponechte si vizi a nejtěžší uvažování jinde, a je těžké ho překonat v nákladech na dokončený úkol.
Často kladené otázky
Jaké je kontextové okno DeepSeek V4 Flash?
1M tokenů na vstupu a až 384K tokenů výstupu na odpověď. DeepSeek doporučuje plný strop 384K výstupu na úrovních úsilí high a max.
Kolik stojí DeepSeek V4 Flash?
Cena dodavatele je 0,14 USD za 1M vstupních tokenů a 0,28 USD za 1M výstupních tokenů, s cache hity za 0,0028 USD za 1M a bez poplatku za zápisy do cache. Na Okou se nachází v cenové úrovni $, nejlevnější ze čtyř. DeepSeek oznámil politiku pro špičkové hodiny, která by zdvojnásobila jeho vlastní ceníkové ceny mezi 09:00-12:00 a 14:00-18:00 pekingského času; zatím nevstoupila v platnost.
Je DeepSeek V4 Flash lepší než DeepSeek V4 Pro?
Na devíti agentních benchmarcích, které DeepSeek zveřejnil pro sestavení 0731, ano: dosahuje vyššího skóre než V4 Pro (Preview) na každém z nich, přičemž aktivuje 13B parametrů oproti 49B Pro. Pro si udržuje náskok v dlouhodobém vícestupňovém uvažování. V4 Pro již není nabízen na Okou.
Podporuje DeepSeek V4 Flash vizi?
Ne. Přijímá pouze text a kód. Kroky řízené snímky obrazovky, grafy nebo PDF směrujte na multimodální model, jako je Claude Sonnet 4.6 nebo GPT 5.6 Luna.
Jaký framework používá DeepSeek V4 Flash na Okou?
Codex. Okou ji směruje přes DeepSeek's Responses API, což je v současné době jediný model DeepSeek, který V4 Flash podporuje. Spusťte ji jako vestavěný model účtovaný v kreditech Okou, nebo si přineste vlastní klíč DeepSeek API.
Alternativy
Používání DeepSeek V4 Flash na Okou
Dva způsoby přístupu k DeepSeek V4 Flash na Okou
Okou podporuje DeepSeek V4 Flash jako vestavěný model účtovaný v kreditech Okou a prostřednictvím vlastního přinesení s DeepSeek API key. Vestavěná cesta používá Okou Managed routing a cenovou úroveň vysvětlenou níže; cesta vlastního přinesení vám účtuje přímo u dodavatele a zcela přeskočí konverzi kreditů Okou.
Doporučení Okou
Okou umisťuje DeepSeek V4 Flash jako možnost úspory nákladů pro hromadnou klasifikaci, předfiltry, odpovědi citlivé na latenci a další vysoce objemovou práci.
Kredity a cenová úroveň $
Okou oceňuje každý vestavěný model na čtyřstupňové kreditní škále – $, $$, $$$, $$$$ – zobrazené jako odznak ve výběru modelu a na řádku price tier v zero model ls. DeepSeek V4 Flash se nachází na $. Tato úroveň je to, co utratíte ze svého kreditního zůstatku Okou; ceníková cena dodavatele v tabulce výše je to, co si účtuje upstream poskytovatel, než to Okou převede na kredity.
Dostupné na Okou od July 31, 2026.

