DeepSeek V4 Flash på Okou. Agent-grade koding til den billigste prisklassen
DeepSeeks åpen-vekt 284B Mixture-of-Experts-modell med 13B aktiv per token. 0731-bygget slår V4 Pro på alle agent-benchmarks DeepSeek publiserte, til $0.14 / $0.28 per 1M tokens.
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash er effektivitetshalvdelen av DeepSeeks V4-generasjon: en 284B-parameter Mixture-of-Experts-modell som aktiverer 13B parametere per token, utgitt under MIT-lisensen med åpne vekter. 0731-bygget som ble levert 31. juli 2026, beholdt arkitekturen uendret og kjørte ettertrening på agentdata, noe som flyttet den forbi DeepSeek V4 Pro (forhåndsvisning) på alle ni agentreferansepunkter DeepSeek publiserte – 82,7 mot 72,1 på Terminal-Bench 2.1, og 54,4 mot 12,8 på DeepSWE.
Leverandørens listepris er 0,14 USD / 0,28 USD per 1 million tokens, med hurtigbuffer-treff til 0,0028 USD / 1 million og ingen kostnad for hurtigbuffer-skrivinger, noe som gjør den til den billigste resonnementsmodellen i Okous nåværende utvalg. Den har et kontekstvindu på 1 million tokens, opptil 384K utdata, og tenkemodus er på som standard. Den er kun tekstbasert: ingen visjon. Velg Claude Sonnet 4.6 når et trinn trenger bilder eller Claude Code-rammeverket, og for GPT 5.6 Luna når du vil ha den billige versjonen av OpenAI-familien i stedet.
Hva er DeepSeek V4 Flash?
31. juli 2026 (DeepSeek-V4-Flash-0731, offentlig beta) · Effektivitetshalvdelen av DeepSeek V4-familien: 13B aktive parametere mot V4 Pros 49B, ettertrent for agentarbeid.
DeepSeek V4 Flash dukket først opp 24. april 2026 som den mindre halvdelen av V4-familien – en 284B-parameter MoE med 13B aktiv per token og et 1M-token kontekstvindu, ved siden av 1.6T-parameter V4 Pro. Den forlot forhåndsvisningen 31. juli 2026 som DeepSeek-V4-Flash-0731, en offentlig beta-versjon som beholdt arkitekturen urørt og kjørte kun post-treningspasset på nytt, denne gangen på agent-smaksatt data.
Den omskoleringen er hele historien om utgivelsen. Ifølge DeepSeeks egne tall slår 0731-bygget V4 Pro (Preview) på alle ni publiserte agent-benchmarks, samtidig som det aktiverer omtrent en fjerdedel av parametrene: Terminal-Bench 2.1 går fra 61.8 i Flash-forhåndsvisningen til 82.7, DeepSWE fra 7.3 til 54.4, Toolathlon-Verified fra 49.7 til 70.3. Flere av disse lander innenfor noen få poeng fra Claude Opus 4.8 – 82.7 mot 85.0 på Terminal-Bench 2.1, 25.2 mot 25.7 på Agents' Last Exam – til en brøkdel av prisen.
Forbeholdene er verdt å nevne tydelig. Hver score er DeepSeek-rapportert og kjørt med DeepSeek Harness, som ikke er utgitt, så ingen av dem er reprodusert uavhengig, og to av de ni settene er DeepSeeks interne. Modellen er kun tekstbasert, ligger bak frontlinjen på resonnement på høyere nivå, og henger fortsatt etter V4 Pro på langsiktige flertrinns oppgaver. Tenkemodus er på som standard, og tenketokens faktureres som utdata.
Hva er bemerkelsesverdig med DeepSeek V4 Flash
Overskriftsarkitektur og funksjonsfunksjoner.
V4 Flash er en sparsom Mixture-of-Experts-modell: 284B totale parametere med 13B aktivert per token, der hvert MoE-lag inneholder 1 delt ekspert og 256 rutet eksperter ved en mellomliggende dimensjon på 2048, og 6 rutet eksperter aktiveres per token. De tre første MoE-lagene bruker hash-ruting, og multi-token prediksjonsdybde er 1. Den publiserte 0731-sjekkpunktet er 304B parametere fordi den leveres med en spekulativ-dekodingsutkastmodul på toppen av den 284B-basen. Den støtter et 1M-token kontekstvindu med opptil 384K utdata, tenkende og ikke-tenkende moduser, og en reasoning_effort-parameter med low, high og max-nivåer. Vektene er MIT-lisensiert og ubeskyttet.
Spesifikasjoner på et øyeblikk
DeepSeek V4 Flash referansepunkter
DeepSeek-rapporterte tall fra DeepSeek-V4-Flash-0731 modellkort, kjørt med DeepSeek Harness i minimal modus med maksimal resonnementsinnsats (temperatur 1.0, top_p 0.95). Harness er ikke utgitt, så ingen av disse er reprodusert uavhengig, og DSBench-FullStack og DSBench-Hard er DeepSeeks interne testsett.
DeepSeek V4 Flash priser
Leverandørens listepris, per 1M tokens.
Hvordan DeepSeek V4 Flash oppfører seg i praksis
Observert atferd fra produksjonsagentkjøringer.
Agentisk utførelse
0731-post-treningsmålene er nøyaktig dette: å drive en terminal, kalle verktøy i rekkefølge og fullføre en oppgave uten en menneskelig innblanding. 82.7 på Terminal-Bench 2.1 og 70.3 på Toolathlon-Verified plasserer den i frontlinjen for prisen.
Kostnadsprofil
$0.14 / $0.28 per 1M tokens, cache-treff til $0.0028 / 1M, og cache-skriving faktureres ikke i det hele tatt. Det er den billigste posisjonen i den nåværende serien og omtrent en tredjedel av V4 Pros utdata-pris, så det er modellen å peke på for høyvolumsarbeid.
Lang kontekst
1M tokens inn og opptil 384K ut, så lesing av hele repositoriet og lange transkripsjoner passer uten oppdeling. Kvaliteten på lange, mange-trinns agentløkker henger fortsatt etter V4 Pro.
Resonneringsdybde
Tre reasoning_effort-nivåer – low, high og max – bytter latens mot overveielse, og DeepSeeks publiserte poengsummer er alle på max. Argumentasjon på masternivå er ikke dens styrke; det er der Claude Opus 5 og GPT 5.6 Sol ligger foran.
Modaliteter
Kun tekst og kode. Alt med et skjermbilde, en skannet PDF eller et diagram i loopen krever en visjonsmodell som Claude Sonnet 4.6 eller GPT 5.6 Luna.
Beste agentoppgaver for DeepSeek V4 Flash
Høyvolumskodingsagenter
Masse-PR-gjennomgang, testskriving, lint-og-fix-pass og planlagte refaktoreringer, der den samme agenten kjører hundrevis av ganger om dagen. Til $0,28 per 1M utdata-tokens holder kostnaden per kjøring seg lav nok til at volumet slutter å være begrensningen.
Terminal- og verktøydrevet automatisering
De sterkeste publiserte resultatene fra 0731-bygget er på terminalarbeid og verktøybruk, noe som er akkurat det en build-fix, deployment-check eller log-triage-agent gjør hele dagen.
Repository-bred lesing
Et 1M-token-vindu tar et helt mellomstort depot, en lang hendelses tidslinje eller et komplett sett med designdokumenter i ett pass, slik at en migrasjons- eller revisjonsagent kan resonnere over hele saken i stedet for bit for bit.
Det billige laget under en grenseorkestrator
La Claude Opus 5 eller GPT 5.6 Sol planlegge og gjennomgå, og overlat de mange mekaniske trinnene – lesing av filer, kjøring av kommandoer, utarbeidelse av patcher – til V4 Flash. Du betaler grenseprisen bare for trinnene som bestemmer kjøringen.
Når du skal hoppe over DeepSeek V4 Flash
Hopp over V4 Flash på alt med bilder i loopen, siden den ikke har syn, og på resonnement på høyere nivå, der grensemodellene fortsatt er klart foran. Langsiktige kjøringer som forblir sammenhengende over mange timer, er fortsatt V4 Pros og Claude Opus' territorium. Og behandle de publiserte agentscorene som leverandørpåstander til DeepSeek Harness sendes: benchmark dem på ditt eget depot før du flytter en produksjonsagent over.
DeepSeek V4 Flash vs andre modeller
DeepSeek V4 Flash vs DeepSeek V4 Pro
Samme familie, motsatt bytte. Pro er flaggskipet på 1,6T med 49B aktive per token; Flash aktiverer 13B og koster en tredjedel av Pros utsalgspris. På DeepSeeks publiserte agent-benchmarks scorer 0731 Flash-bygget nå høyere enn V4 Pro (Preview) på alle ni, så argumentet for Pro er dybde på lang flertrinns resonnering snarere enn agentgjennomstrømning. V4 Pro tilbys ikke lenger på Okou – siden her er referansemateriale.
DeepSeek V4 Flash vs GPT 5.6 Luna
Begge er den billige varianten av sin familie, og begge kjører på Codex-rammeverket. Luna er multimodal og støttet av OpenAIs økosystem; Flash er tekst-eneste, åpen vekt, koster under en fjerdedel av Lunas utgangspris, og viser langt sterkere publiserte agent-benchmark-resultater. Velg Luna når du trenger visjon eller OpenAI-spesifikk oppførsel, Flash når arbeidet er kode og verktøy.
DeepSeek V4 Flash vs Claude Sonnet 4.6
Sonnet 4.6 er en kjernemodell for agenter med visjon, Claude Code-rammeverket og Anthropics verktøyruting-pålitelighet; Flash er en kostnadsbesparende, tekst-bare modell til omtrent en femtiendedel av Sonnets utgangspris. Behold Sonnet på trinnene som bestemmer en kjøring og gi Flash volumet under den.
Konklusjon: bør du bruke DeepSeek V4 Flash?
DeepSeek V4 Flash er den billigste måten å kjøre en kompetent kodeagent på Okou: grensenære agent-benchmarks, et 1M-token-vindu og $0.28 per 1M utdata-tokens. Verifiser leverandørens tall på ditt eget repository, hold visjon og den vanskeligste resonneringen andre steder, og det er vanskelig å slå på kostnad per fullført oppgave.
Ofte stilte spørsmål
Hva er DeepSeek V4 Flashs kontekstvindu?
1M tokens inn, og opptil 384K tokens ut per svar. DeepSeek anbefaler det fulle 384K utgangstaket på high og max resonnementsnivåer.
Hvor mye koster DeepSeek V4 Flash?
Leverandørens listepris er $0,14 per 1M inndatatoken og $0,28 per 1M utdata, med cache-treff til $0,0028 per 1M og ingen kostnad for cache-skrivinger. På Okou ligger den i $ prisnivå, det billigste av de fire. DeepSeek har annonsert en peak-hours-policy som ville doble sine egne listepriser mellom 09:00-12:00 og 14:00-18:00 Beijing-tid; den har ikke trådt i kraft ennå.
Er DeepSeek V4 Flash bedre enn DeepSeek V4 Pro?
På de ni agent-benchmarkene DeepSeek publiserte for 0731-bygget, ja: den scorer høyere enn V4 Pro (Preview) på hver eneste, samtidig som den aktiverer 13B parametere mot Pros 49B. Pro beholder fordelen på langvarig flertrinns resonnement. V4 Pro tilbys ikke lenger på Okou.
Støtter DeepSeek V4 Flash syn?
Nei. Den tar kun tekst og kode. Send skjermbilde-, diagram- eller PDF-drevne trinn til en multimodal modell som Claude Sonnet 4.6 eller GPT 5.6 Luna.
Hvilket rammeverk bruker DeepSeek V4 Flash på Okou?
Codex. Okou ruter den gjennom DeepSeeks Responses API, som V4 Flash for øyeblikket er den eneste DeepSeek-modellen som støtter. Kjør den som en innebygd modell fakturert i Okou-kreditter, eller ta med din egen DeepSeek API-nøkkel.
Alternativer
Bruker DeepSeek V4 Flash på Okou
To måter å få tilgang til DeepSeek V4 Flash på Okou
Okou støtter DeepSeek V4 Flash som en innebygd modell fakturert i Okou-kreditter, og gjennom bring-your-own med en DeepSeek API key. Den innebygde veien bruker Okou Managed-ruting og prisnivået forklart nedenfor; bring-your-own-veien fakturerer deg direkte med den oppstrøms leverandøren og hopper over Okou-kredittkonverteringen helt.
Okous anbefaling
Okou posisjonerer DeepSeek V4 Flash som et kostnadsbesparende alternativ for massekategorisering, forhåndsfiltre, latenssensitive svar og annet høyvolumsarbeid.
Kreditter og $ prisnivå
Okou priser hver innebygde modell på en fire-trinns kredittskala – $, $$, $$$, $$$$ – vist som et merke i modellvelgeren og på price tier-linjen i zero model ls. DeepSeek V4 Flash ligger på $. Det nivået er det du bruker fra din Okou-kredittsaldo; leverandørens listepris i tabellen ovenfor er det oppstrømsleverandøren tar før Okou konverterer det til kreditter.
Tilgjengelig på Okou siden July 31, 2026.

