Všechny modely

DeepSeek V4 Flash na Okou. Kódování na úrovni agenta za nejlevnější cenu

DeepSeekův open-weight 284B Mixture-of-Experts model s 13B aktivními na token. Sestavení 0731 překonává V4 Pro ve všech agentních benchmarcích, které DeepSeek zveřejnil, za 0,14 $ / 0,28 $ za 1M tokenů.

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash je efektivní polovina generace V4 od DeepSeek: model Mixture-of-Experts s 284B parametry, který aktivuje 13B parametrů na token, vydaný pod licencí MIT s otevřenými váhami. Sestavení 0731, které bylo dodáno 31. července 2026, zachovalo architekturu beze změny a znovu spustilo post-trénink na datech agentů, což ho posunulo za DeepSeek V4 Pro (Preview) na všech devíti benchmarcích agentů, které DeepSeek publikoval – 82,7 proti 72,1 na Terminal-Bench 2.1 a 54,4 proti 12,8 na DeepSWE.

Ceníková cena prodejce je 0,14 $ / 0,28 $ za 1M tokenů, s cache hity za 0,0028 $ / 1M a bez poplatku za zápisy do cache, což z něj činí nejlevnější model pro uvažování v současné nabídce Okou. Má kontextové okno 1M tokenů, až 384K výstupu a režim myšlení je ve výchozím nastavení zapnutý. Je pouze textový: bez vize. Sáhněte po Claude Sonnet 4.6, když krok vyžaduje obrázky nebo framework Claude Code, a po GPT 5.6 Luna, když chcete levnější úroveň rodiny OpenAI.

Co je DeepSeek V4 Flash?

31. července 2026 (DeepSeek-V4-Flash-0731, veřejná beta) · Úspornější polovina rodiny DeepSeek V4: 13B aktivních parametrů oproti 49B u V4 Pro, dodatečně trénovaná pro práci agentů.

DeepSeek V4 Flash se poprvé objevil 24. dubna 2026 jako menší polovina rodiny V4 – MoE s 284B parametry s 13B aktivními na token a kontextovým oknem 1M tokenů, vedle V4 Pro s 1.6T parametry. Z předběžné verze vyšel 31. července 2026 jako DeepSeek-V4-Flash-0731, veřejná beta verze, která zachovala architekturu nedotčenou a znovu spustila pouze post-tréninkový průchod, tentokrát na datech s agentním zaměřením.

Toto přeškolení je celým příběhem vydání. Podle vlastních čísel DeepSeeku překonává sestavení 0731 V4 Pro (Preview) ve všech devíti publikovaných benchmarkech agentů, přičemž aktivuje zhruba čtvrtinu parametrů: Terminal-Bench 2.1 jde z 61.8 v Flash preview na 82.7, DeepSWE ze 7.3 na 54.4, Toolathlon-Verified ze 49.7 na 70.3. Několik z nich se pohybuje v řádu několika bodů od Claude Opus 4.8 – 82.7 proti 85.0 na Terminal-Bench 2.1, 25.2 proti 25.7 na Agents' Last Exam – za zlomek ceny.

Je třeba jasně uvést výhrady. Každé skóre je hlášeno společností DeepSeek a spuštěno s DeepSeek Harness, který nebyl vydán, takže nic z toho nebylo nezávisle reprodukováno a dvě z devíti sad jsou interní sady DeepSeeku. Model je pouze textový, zaostává za špičkou v uvažování na úrovni absolventů a stále zaostává za V4 Pro v dlouhodobých vícestupňových úkolech. Režim myšlení je standardně zapnutý a tokeny myšlení se účtují jako výstup.

Co je pozoruhodné na DeepSeek V4 Flash

Architektura nadpisů a funkce schopností.

V4 Flash je řídký model Mixture-of-Experts: celkem 284B parametrů s 13B aktivovanými na token, kde každá vrstva MoE obsahuje 1 sdíleného experta a 256 směrovaných expertů s mezilehlou dimenzí 2048, a 6 směrovaných expertů se spouští na token. První tři vrstvy MoE používají hashové směrování a hloubka predikce více tokenů je 1. Publikovaný kontrolní bod 0731 má 304B parametrů, protože obsahuje modul pro spekulativní dekódování nad základem 284B. Podporuje kontextové okno 1M tokenů s až 384K výstupu, režimy myšlení a nemyšlení a parametr reasoning_effort s úrovněmi low, high a max. Váhy jsou licencovány pod MIT a jsou neomezené.

Specifikace na první pohled

RodinaŘada DeepSeek V4 (Flash)
ParametryCelkem 284B / 13B aktivních (MoE)
ModalitaText, kód (bez vize)
LicenceMIT, otevřené váhy
Ukládání výzev do mezipamětiPodporováno (DeepSeek)
Kontextové okno1M tokenů
Maximální výstupAž 384K tokenů
Úsilí o uvažováníNízká / Vysoká / Max
Cena dodavatele0,14 $ vstup / 0,28 $ výstup na 1M

Benchmarky DeepSeek V4 Flash

DeepSeek-hlášené údaje z karty modelu DeepSeek-V4-Flash-0731, spuštěné s DeepSeek Harness v minimálním režimu s maximálním úsilím o uvažování (teplota 1.0, top_p 0.95). Harness nebyl vydán, takže žádný z těchto údajů nebyl nezávisle reprodukován a DSBench-FullStack a DSBench-Hard jsou interní testovací sady DeepSeek.

Terminal-Bench 2.1agentní terminálová práce; V4 Pro (Preview) 72.1
82.7
SWE-bench Verifiednáhledová verze, hlášeno dodavatelem
79.0%
Cybergymnahlášeno dodavatelem
76.7
Toolathlon (ověřeno)použití nástroje; V4 Pro (náhled) 55.9
70.3
DSBench-FullStackInterní sada DeepSeek
68.7
DSBench-HardInterní sada DeepSeek
59.6
DeepSWEnahoru z 7.3 v náhledové verzi
54.4
NL2Repokonstrukce úložiště
54.2
Poslední zkouška agentůClaude Opus 4.8 dosahuje 25.7
25.2

Ceny DeepSeek V4 Flash

Cena poskytovatele, za 1M tokenů.

Vstup$0.14
Výstup$0.28
Čtení z mezipaměti$0.003
Zápis do mezipamětiNení účtováno

Jak se DeepSeek V4 Flash chová v praxi

Pozorované chování z běhů produkčních agentů.

Agentní provedení

Cíle po tréninku 0731 se zaměřují přesně na toto: řízení terminálu, sekvenční volání nástrojů a dokončení úkolu bez lidského zásahu. 82.7 na Terminal-Bench 2.1 a 70.3 na Toolathlon-Verified ho řadí mezi špičku za danou cenu.

Nákladový profil

0,14 $ / 0,28 $ za 1M tokenů, zásahy do cache za 0,0028 $ / 1M a zápisy do cache se neúčtují vůbec. To je nejlevnější pozice v současné nabídce a zhruba třetina výstupní ceny V4 Pro, takže je to model pro práci s vysokým objemem.

Dlouhý kontext

1M tokenů dovnitř a až 384K ven, takže čtení celého úložiště a dlouhé přepisy se vejdou bez rozdělování. Kvalita u dlouhodobých, vícestupňových agentních smyček stále zaostává za V4 Pro.

Hloubka uvažování

Tři úrovně reasoning_effortlow, high a max – vyměňují latenci za rozvahu a publikovaná skóre DeepSeek jsou všechna na max. Uvažování na úrovni absolventů není jeho silnou stránkou; tam zůstávají Claude Opus 5 a GPT 5.6 Sol napřed.

Modalita

Pouze text a kód. Cokoli se snímkem obrazovky, naskenovaným PDF nebo grafem ve smyčce vyžaduje vizuální model, jako je Claude Sonnet 4.6 nebo GPT 5.6 Luna.

Nejlepší úkoly agenta pro DeepSeek V4 Flash

Agenti pro kódování s vysokým objemem

Hromadné revize PR, psaní testů, lint-and-fix průchody a plánované refaktoringy, kde stejný agent běží stokrát denně. Při 0,28 $ za 1M výstupních tokenů zůstávají náklady na jedno spuštění dostatečně nízké, takže objem přestává být omezením.

Automatizace řízená terminálem a nástroji

Nejsilnější publikované výsledky sestavení 0731 jsou v terminálové práci a používání nástrojů, což je přesně to, co agent pro opravu sestavení, kontrolu nasazení nebo třídění protokolů dělá celý den.

Čtení celého úložiště

Okno 1M tokenů pojme celý středně velký repozitář, dlouhou časovou osu incidentu nebo kompletní sadu návrhových dokumentů v jednom průchodu, takže migrační nebo auditní agent může uvažovat o celé věci namísto po částech.

Levná vrstva pod hraničním orchestrátorem

Nechte Claude Opus 5 nebo GPT 5.6 Sol plánovat a revidovat a mnoho mechanických kroků – čtení souborů, spouštění příkazů, navrhování záplat – předejte V4 Flash. Hraniční sazbu platíte pouze za kroky, které rozhodují o běhu.

Kdy přeskočit DeepSeek V4 Flash

V4 Flash přeskočte u všeho, co obsahuje obrázky ve smyčce, protože nemá vizi, a u uvažování na úrovni absolventů, kde jsou hraniční modely stále jasně napřed. Dlouhodobé běhy, které zůstávají koherentní po mnoho hodin, zůstávají doménou V4 Pro a Claude Opus. A zveřejněné skóre agentů považujte za tvrzení dodavatele, dokud nebude dodán DeepSeek Harness: otestujte je na svém vlastním úložišti, než přesunete produkčního agenta.

DeepSeek V4 Flash vs. jiné modely

DeepSeek V4 Flash vs DeepSeek V4 Pro

Stejná rodina, opačný kompromis. Pro je vlajková loď s 1,6T a 49B aktivními na token; Flash aktivuje 13B a je uveden za třetinu ceny výstupu Pro. Na publikovaných agentních benchmarcích DeepSeeku nyní 0731 Flash build dosahuje vyšších skóre než V4 Pro (Preview) ve všech devíti, takže argumentem pro Pro je hloubka v dlouhém vícestupňovém uvažování spíše než propustnost agenta. V4 Pro již není nabízen na Okou – jeho stránka zde je referenční materiál.

DeepSeek V4 Flash vs GPT 5.6 Luna

Oba jsou levnou úrovní své rodiny a oba běží na frameworku Codex. Luna je multimodální a podporovaná ekosystémem OpenAI; Flash je pouze textový, s otevřenou váhou, stojí méně než čtvrtinu ceny výstupu Luny a vykazuje mnohem silnější publikované výsledky benchmarků agentů. Vyberte Lunu, když potřebujete vizi nebo chování specifické pro OpenAI, Flash, když je práce kód a nástroje.

DeepSeek V4 Flash vs Claude Sonnet 4.6

Sonnet 4.6 je základní model agenta s vizí, frameworkem Claude Code a spolehlivostí směrování nástrojů Anthropic; Flash je cenově úsporný, pouze textový model za zhruba padesátinu výstupní ceny Sonnetu. Ponechte Sonnet na krocích, které rozhodují o spuštění, a dejte Flashu objem pod ním.

Sečteno a podtrženo: měli byste používat DeepSeek V4 Flash?

DeepSeek V4 Flash je nejlevnější způsob, jak spustit kompetentního kódovacího agenta na Okou: hraniční agentní benchmarky, okno 1M tokenů a 0,28 $ za 1M výstupních tokenů. Ověřte si čísla dodavatele na svém vlastním úložišti, ponechte si vizi a nejtěžší uvažování jinde, a je těžké ho překonat v nákladech na dokončený úkol.

Často kladené otázky

Jaké je kontextové okno DeepSeek V4 Flash?

1M tokenů na vstupu a až 384K tokenů výstupu na odpověď. DeepSeek doporučuje plný strop 384K výstupu na úrovních úsilí high a max.

Kolik stojí DeepSeek V4 Flash?

Cena dodavatele je 0,14 USD za 1M vstupních tokenů a 0,28 USD za 1M výstupních tokenů, s cache hity za 0,0028 USD za 1M a bez poplatku za zápisy do cache. Na Okou se nachází v cenové úrovni $, nejlevnější ze čtyř. DeepSeek oznámil politiku pro špičkové hodiny, která by zdvojnásobila jeho vlastní ceníkové ceny mezi 09:00-12:00 a 14:00-18:00 pekingského času; zatím nevstoupila v platnost.

Je DeepSeek V4 Flash lepší než DeepSeek V4 Pro?

Na devíti agentních benchmarcích, které DeepSeek zveřejnil pro sestavení 0731, ano: dosahuje vyššího skóre než V4 Pro (Preview) na každém z nich, přičemž aktivuje 13B parametrů oproti 49B Pro. Pro si udržuje náskok v dlouhodobém vícestupňovém uvažování. V4 Pro již není nabízen na Okou.

Podporuje DeepSeek V4 Flash vizi?

Ne. Přijímá pouze text a kód. Kroky řízené snímky obrazovky, grafy nebo PDF směrujte na multimodální model, jako je Claude Sonnet 4.6 nebo GPT 5.6 Luna.

Jaký framework používá DeepSeek V4 Flash na Okou?

Codex. Okou ji směruje přes DeepSeek's Responses API, což je v současné době jediný model DeepSeek, který V4 Flash podporuje. Spusťte ji jako vestavěný model účtovaný v kreditech Okou, nebo si přineste vlastní klíč DeepSeek API.

Alternativy

Používání DeepSeek V4 Flash na Okou

Dva způsoby přístupu k DeepSeek V4 Flash na Okou

Okou podporuje DeepSeek V4 Flash jako vestavěný model účtovaný v kreditech Okou a prostřednictvím vlastního přinesení s DeepSeek API key. Vestavěná cesta používá Okou Managed routing a cenovou úroveň vysvětlenou níže; cesta vlastního přinesení vám účtuje přímo u dodavatele a zcela přeskočí konverzi kreditů Okou.

Doporučení Okou

Okou umisťuje DeepSeek V4 Flash jako možnost úspory nákladů pro hromadnou klasifikaci, předfiltry, odpovědi citlivé na latenci a další vysoce objemovou práci.

Kredity a cenová úroveň $

Okou oceňuje každý vestavěný model na čtyřstupňové kreditní škále – $, $$, $$$, $$$$ – zobrazené jako odznak ve výběru modelu a na řádku price tier v zero model ls. DeepSeek V4 Flash se nachází na $. Tato úroveň je to, co utratíte ze svého kreditního zůstatku Okou; ceníková cena dodavatele v tabulce výše je to, co si účtuje upstream poskytovatel, než to Okou převede na kredity.

Dostupné na Okou od July 31, 2026.