DeepSeek V4 Pro: en 1M-token ræsonnementsmodel
DeepSeeks flagskibs V4 ræsonnementsmodel. Inden for 0,2 point af Claude Opus 4.6 på SWE-bench Verified til en syvendedel af leverandøromkostningerne. Claude-kompatibel API.
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Pro er flagskibet i DeepSeeks V4-generation – en open-weight 1.6T-parameter MoE under MIT-licensen. Overskriften er pris-kvalitetsforholdet: leverandørrapporteret SWE-bench Verified er 80,6 %, inden for en brøkdel af et punkt fra Claude Opus 4.6, til omtrent en syvendedel af Anthropic's leverandøromkostninger. Det gør ræsonnementstunge agenter – bulk PR-gennemgang, batchdokumentanalyse, planlagt opsummering – overkommelige i store mængder.
Leverandørens listepris er 1,74 USD / 3,48 USD pr. 1M tokens med cachelæsninger til 0,028 USD / 1M og gratis cache-skrivninger (unikt i sortimentet). 1M-token kontekst, Anthropic-kompatibel API. Vælg Sonnet 4.6, når pålidelighed i produktionsværktøjsrouting er den afgørende faktor, og for GPT-5.4 Mini eller Kimi K2.7 Code, når enkeltstående bulk-arbejde ikke kræver V4 Pro's ræsonnementsdybde.
Hvad er DeepSeek V4 Pro?
24. april 2026 · Ræsonnementsvariant af DeepSeek V4-familien, fokuseret på maksimal ræsonnementskvalitet.
DeepSeek V4 Pro er flagskibet i DeepSeeks V4-generation, udgivet den 24. april 2026 under MIT-licensen. Det er en open-weight Mixture-of-Experts-model med 1,6T samlede parametre og 49B aktive pr. token.
V4 Pro understøtter et 1M-token kontekstvindue, 384K maksimalt output, tre ræsonnementsindsatsformer (standard, tænk, tænk-max), JSON output, værktøjskald og FIM-fuldførelse i ikke-tænketilstand. Pro-modellen tilføjer en hybrid opmærksomhedsarkitektur (Compressed Sparse Attention + Heavily Compressed Attention) for dramatisk forbedret langkonteksteffektivitet. 27% af single-token inferens FLOPs og 10% af KV cache vs DeepSeek V3.2 ved 1M kontekst.
Hvad er bemærkelsesværdigt ved DeepSeek V4 Pro
Overskriftsarkitektur og kapacitetsfunktioner.
V4 Pro er en Mixture-of-Experts-model med 1,6T samlede parametre og 49B aktive pr. token, frontet af en hybrid opmærksomhedsstak (Compressed Sparse Attention plus Heavily Compressed Attention), der holder lang-kontekst inferens billig. Den understøtter et 1M-token kontekstvindue med 384K maksimal output, tre ræsonnementstilstande (standard, tænk og tænk-max), og bruger Manifold-Constrained Hyper-Connections til stabil signaludbredelse. Modellen blev trænet på 32T+ tokens med Muon-optimereren og er udgivet under MIT-licensen med åbne vægte.
Specifikationer på et øjeblik
DeepSeek V4 Pro benchmarks
Leverandørrapporterede scores fra DeepSeeks V4 Pro-udgivelse. Uafhængige anmeldelser (Geeky Gadgets, Code Arena) placerer V4 Pro som nummer tre på Code Arena efter GLM-5.1 og Kimi K2.7 Code. De stærkeste benchmark-påstande kommer fra DeepSeeks egne materialer. Behandl dem retningsgivende snarere end som absolut sandhed.
DeepSeek V4 Pro priser
Udbyderens listepris, pr. 1M tokens.
Hvordan DeepSeek V4 Pro opfører sig i praksis
Observeret adfærd fra produktionsagentkørsler.
Begrundelse
Stærkeste sub-Sonnet ræsonnement i vores sortiment. Holder stand på flertrinsarbejde, hvor billigere modeller begynder at afvige. Leverandørrapporteret MMLU-Pro matcher GPT-5.4.
Kodningsbenchmarks
Leverandørrapporteret SWE-bench Verificeret 80,6% (inden for 0,2 af Opus 4.6), Terminal-Bench 2.0 67,9% (fører Opus 4.6), LiveCodeBench 93,5%.
Omkostningseffektivitet
$ Built-in-niveauet gør V4 Pro til en omkostningsbesparende ræsonneringsmulighed, samtidig med at den forbliver konkurrencedygtig med Sonnet 4.6.
Hastighed
Omkring 36 tokens/sek. ved maksimal indsats pr. Artificial Analysis. Langsommere end Kimi K2.7 Code, lidt langsommere end Opus 4.6.
Bedste agentopgaver for DeepSeek V4 Pro
PR-review-agenten, der kører på hver commit
Nøjagtighed på Sonnet-niveau til en brøkdel af Sonnets leverandøromkostninger er det, der gør "gennemgå hver commit, ikke kun de store PR'er" faktisk levedygtigt. V4 Pro læser diff'en, de relaterede filer og det linkede problem, og skriver derefter en struktureret kommentar – og prisen pr. opkald er lav nok til, at kørsel som et CI-trin ved hvert push ikke fremstår som en mærkbar post.
Den planlagte opsummering, der kører hver nat
Henter gårsdagens kundesamtaler, supportbilletter eller salgsopkald og skriver et resumé. Systemprompten og værktøjsskemaet ændres ikke mellem kørsler, og DeepSeek fakturerer ikke cache-skrivninger – så det lange faste præfiks betales én gang, og cache-læsninger koster en brøkdel af normal input. Det er her, V4 Pro's prismodel virkelig ændrer, hvad der er overkommeligt.
Hele repo-kodeagenten, der koster mindre end Opus
1M-token kontekst med hybrid opmærksomhed (Compressed Sparse Attention plus Heavily Compressed Attention) betyder, at en mellemstor kodebase passer ind i én prompt, og inferensomkostningerne forbliver håndterbare, efterhånden som vinduet fyldes op. Til refactoring på tværs af filer og arkitektur-niveau anmeldelser er det her, du får den Opus-lignende "se alt på én gang"-arbejdsgang uden den Opus-lignende faktura.
Hvornår man skal springe DeepSeek V4 Pro over
Spring V4 Pro over på de sværeste værktøjsrouting-grænsetilfælde, hvor Sonnet 4.6 stadig fører an, og på bulk single-shot-arbejde, hvor GPT-5.4 Mini eller Kimi K2.7 Code er tilstrækkelig til en lavere pris.
DeepSeek V4 Pro vs. andre modeller
DeepSeek V4 Pro vs Claude Sonnet 4.6
Sonnet 4.6 forbliver det mere pålidelige valg til vanskelige værktøjsrouting-edge cases. V4 Pro koster mindre og er konkurrencedygtig på leverandørrapporterede kodningsbenchmarks. A/B-test begge på en rigtig agent, før du standardiserer.
Bundlinjen: skal du bruge DeepSeek V4 Pro?
Forfiltrer med GPT-5.4 Mini eller Kimi K2.7 Code, eskaler til V4 Pro for ræsonnement, eskaler til Sonnet 4.6 kun når V4 Pro går i stå på tool-routing edge cases.
Ofte stillede spørgsmål
Hvornår blev DeepSeek V4 Pro udgivet?
DeepSeek udgav V4 Pro den 24. april 2026 under MIT-licensen med åbne vægte.
Hvorfor er cache-skrivninger gratis?
DeepSeek fakturerer ikke cache-skrivningsdelen. Kun cache-læsninger faktureres til $0,145 pr. 1M tokens. Stabile systemprompter og store referencekontekster koster intet ekstra at cache.
Hvad er V4 Pro's kontekstvindue?
1 million tokens med op til 384K tokens output. Den hybride opmærksomhedsarkitektur gør hele vinduet brugbart til en meget lavere inferensomkostning end V3.2.
Hvordan sammenligner V4 Pro sig med Claude Opus 4.6?
Leverandørrapporteret SWE-bench Verified er inden for 0,2 point (80,6 vs. 80,8). Terminal-Bench 2.0 favoriserer V4 Pro (67,9 vs. 65,4). Opus 4.6 fører på HLE (40,0 vs. 37,7) og HMMT 2026 matematik (96,2 vs. 95,2). Til ~7 gange lavere leverandøromkostninger er V4 Pro det rigtige valg, når ræsonnementskvalitet er målestokken, men omkostninger betyder noget.
Bruger DeepSeek V4 Pro på Okou
To måder at få adgang til DeepSeek V4 Pro på Okou
Okou understøtter DeepSeek V4 Pro som en indbygget model, der faktureres i Okou-kreditter, og via bring-your-own med en DeepSeek API key. Den indbyggede sti bruger Okou Managed routing og den prisklasse, der er forklaret nedenfor; bring-your-own-stien fakturerer dig direkte hos den oprindelige leverandør og springer Okou-kreditkonverteringen helt over.
Okou's anbefaling
Okou positionerer DeepSeek V4 Pro som en omkostningsbesparende mulighed for bulkklassificering, forfiltrering, latensfølsomme svar og andet højvolumenarbejde.
Kreditter og $ prisniveau
Okou prissætter hver indbygget model på en firetrins kredit-skala — $, $$, $$$, $$$$ — vist som et badge i modelvælgeren og på price tier-linjen i zero model ls. DeepSeek V4 Pro ligger på $. Det niveau er, hvad du bruger fra din Okou-kreditbalance; leverandørens listepris i tabellen ovenfor er, hvad den opstrøms udbyder opkræver, før Okou konverterer det til kreditter.
Tilgængelig på Okou siden August 12, 2026.

