DeepSeek V4 Pro: een redeneermodel met 1M tokens
DeepSeek's vlaggenschip V4 redeneermodel. Binnen 0,2 punten van Claude Opus 4.6 op SWE-bench Verified tegen een zevende van de leverancierskosten. Claude-compatibel API.
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Pro is het vlaggenschip van DeepSeek's V4-generatie — een open-weight 1.6T-parameter MoE onder de MIT-licentie. De belangrijkste eigenschap is de prijs-kwaliteitverhouding: de door de leverancier gerapporteerde SWE-bench Verified is 80,6%, een fractie van een punt van Claude Opus 4.6, tegen ongeveer een zevende van de leverancierskosten van Anthropic. Dat maakt redeneringsintensieve agents — bulk PR-review, batchdocumentanalyse, geplande samenvatting — betaalbaar in grote volumes.
De catalogusprijs van de leverancier is $1,74 / $3,48 per 1M tokens met cache-reads van $0,028 / 1M en gratis cache-writes (uniek in het assortiment). 1M-token context, Anthropic-compatibele API. Kies voor Sonnet 4.6 wanneer de betrouwbaarheid van tool-routing in productie de doorslaggevende factor is, en voor GPT-5.4 Mini of Kimi K2.7 Code wanneer eenmalig bulkwerk de redeneringsdiepte van V4 Pro niet nodig heeft.
Wat is DeepSeek V4 Pro?
24 april 2026 · Redeneervariant van de DeepSeek V4-familie, gericht op maximale redeneerkwaliteit.
DeepSeek V4 Pro is het vlaggenschip van DeepSeek's V4-generatie, uitgebracht op 24 april 2026 onder de MIT-licentie. Het is een open-weight Mixture-of-Experts-model met 1.6T totale parameters en 49B actief per token.
V4 Pro ondersteunt een 1M-token contextvenster, 384K maximale uitvoer, drie redeneermodi (standaard, denken, denken-max), JSON uitvoer, tool calls en FIM-aanvulling in niet-denkmodus. Het Pro-model voegt een hybride aandachtarchitectuur toe (Compressed Sparse Attention + Heavily Compressed Attention) voor dramatisch verbeterde efficiëntie bij lange contexten. 27% van de single-token inferentie FLOPs en 10% van de KV-cache versus DeepSeek V3.2 bij 1M context.
Wat is opmerkelijk aan DeepSeek V4 Pro
Koparchitectuur en functionaliteiten.
V4 Pro is een Mixture-of-Experts model met 1.6T totale parameters en 49B actief per token, voorzien van een hybride aandachtsstapel (Compressed Sparse Attention plus Heavily Compressed Attention) die lange-context inferentie goedkoop houdt. Het ondersteunt een 1M-token contextvenster met 384K maximale output, drie redeneer-inspanningsmodi (standaard, denken en denken-max), en gebruikt Manifold-Constrained Hyper-Connections voor stabiele signaalpropagatie. Het model is getraind op 32T+ tokens met de Muon-optimizer en wordt uitgebracht onder de MIT-licentie met open gewichten.
Specificaties in één oogopslag
DeepSeek V4 Pro benchmarks
Door leveranciers gerapporteerde scores van DeepSeek's V4 Pro release. Onafhankelijke recensies (Geeky Gadgets, Code Arena) plaatsen V4 Pro als derde op Code Arena achter GLM-5.1 en Kimi K2.7 Code. De sterkste benchmarkclaims komen uit DeepSeek's eigen materialen. Behandel richtinggevend in plaats van als absolute waarheid.
DeepSeek V4 Pro prijzen
Catalogusprijs van de provider, per 1M tokens.
Hoe DeepSeek V4 Pro zich in de praktijk gedraagt
Waargenomen gedrag van productieve agentruns.
Redenering
Sterkste sub-Sonnet redenering in ons assortiment. Houdt stand bij meerstaps werk waar goedkopere modellen beginnen af te dwalen. Door de leverancier gerapporteerde MMLU-Pro komt overeen met GPT-5.4.
Codering benchmarks
Door leverancier gerapporteerd SWE-bench Verified 80,6% (binnen 0,2 van Opus 4.6), Terminal-Bench 2.0 67,9% (leidt Opus 4.6), LiveCodeBench 93,5%.
Kostenefficiëntie
De $ Built-in tier maakt V4 Pro een kostenbesparende redeneeroptie, terwijl het concurrerend blijft met Sonnet 4.6.
Snelheid
Ongeveer 36 tokens/sec bij maximale inspanning per Artificial Analysis. Langzamer dan Kimi K2.7 Code, iets langzamer dan Opus 4.6.
Beste agenttaken voor DeepSeek V4 Pro
De PR-review agent die draait op elke commit
Nauwkeurigheid op Sonnet-niveau tegen een fractie van de leverancierskosten van Sonnet maakt "elke commit beoordelen, niet alleen de grote PR's" daadwerkelijk haalbaar. V4 Pro leest de diff, de gerelateerde bestanden en het gekoppelde issue, en schrijft vervolgens een gestructureerde opmerking — en de prijs per oproep is laag genoeg dat het uitvoeren ervan als een CI-stap bij elke push niet opvalt als een merkbare kostenpost.
De geplande samenvatter die elke nacht draait
Haalt de klantgesprekken, supporttickets of verkoopgesprekken van gisteren op en schrijft een samenvatting. Het systeemprompt en het tool-schema veranderen niet tussen runs, en DeepSeek brengt geen kosten in rekening voor cache-writes — dus de lange vaste prefix wordt één keer betaald en gecachte reads kosten een fractie van de normale invoer. Dit is waar het prijsmodel van V4 Pro echt verandert wat betaalbaar is.
De code-agent voor de hele repository die minder kost dan Opus
1M-token context met hybride aandacht (Compressed Sparse Attention plus Heavily Compressed Attention) betekent dat een middelgrote codebase in één prompt past en de inferentiekosten beheersbaar blijven naarmate het venster voller wordt. Voor cross-file refactors en architectuur-niveau reviews is dit waar je de Opus-stijl "alles tegelijk zien" workflow krijgt zonder de Opus-stijl factuur.
Wanneer DeepSeek V4 Pro overslaan
Sla V4 Pro over bij de moeilijkste tool-routing edge cases waar Sonnet 4.6 nog steeds de leiding heeft, en bij bulk single-shot werk waar GPT-5.4 Mini of Kimi K2.7 Code voldoende is tegen lagere kosten.
DeepSeek V4 Pro versus andere modellen
DeepSeek V4 Pro vs Claude Sonnet 4.6
Sonnet 4.6 blijft de betrouwbaardere keuze voor moeilijke tool-routing edge cases. V4 Pro kost minder en is concurrerend op door leveranciers gerapporteerde codeerbenchmarks. A/B-test beide op een echte agent voordat u standaardiseert.
Conclusie: moet je DeepSeek V4 Pro gebruiken?
Voorfilteren met GPT-5.4 Mini of Kimi K2.7 Code, escaleren naar V4 Pro voor redenering, escaleren naar Sonnet 4.6 alleen wanneer V4 Pro vastloopt op tool-routing edge cases.
Veelgestelde vragen
Wanneer werd DeepSeek V4 Pro uitgebracht?
DeepSeek bracht V4 Pro uit op 24 april 2026 onder de MIT-licentie met open gewichten.
Waarom zijn cache-writes gratis?
DeepSeek factureert het cache-schrijfgedeelte niet. Alleen cache-lezingen worden gefactureerd, tegen $0,145 per 1M tokens. Stabiele systeemprompts en grote referentiecontexten kosten niets extra om te cachen.
Wat is het contextvenster van V4 Pro?
1 miljoen tokens met een output van maximaal 384K tokens. De hybride aandachtarchitectuur maakt het volledige venster bruikbaar tegen veel lagere inferentiekosten dan V3.2.
Hoe verhoudt V4 Pro zich tot Claude Opus 4.6?
Door de leverancier gerapporteerde SWE-bench Verified ligt binnen 0,2 punten (80,6 vs 80,8). Terminal-Bench 2.0 bevoordeelt V4 Pro (67,9 vs 65,4). Opus 4.6 leidt op HLE (40,0 vs 37,7) en HMMT 2026 wiskunde (96,2 vs 95,2). Met ~7x lagere leverancierskosten is V4 Pro de juiste keuze wanneer redeneerkwaliteit de norm is, maar kosten belangrijk zijn.
DeepSeek V4 Pro gebruiken op Okou
Twee manieren om toegang te krijgen tot DeepSeek V4 Pro op Okou
Okou ondersteunt DeepSeek V4 Pro als een ingebouwd model dat wordt gefactureerd in Okou-credits, en via 'bring-your-own' met een DeepSeek API key. Het ingebouwde pad maakt gebruik van Okou Managed routing en de hieronder uitgelegde prijscategorie; het 'bring-your-own' pad factureert u rechtstreeks bij de upstream leverancier en slaat de Okou-creditconversie volledig over.
Aanbeveling van Okou
Okou positioneert DeepSeek V4 Pro als een kostenbesparende optie voor bulkclassificatie, voorfilters, latency-gevoelige antwoorden en ander werk met een hoog volume.
Credits en de $ prijscategorie
Okou prijst elk ingebouwd model op een vierstaps creditschaal — $, $$, $$$, $$$$ — weergegeven als een badge in de modelkiezer en op de price tier-regel van zero model ls. DeepSeek V4 Pro bevindt zich op $. Die laag is wat je uitgeeft van je Okou-creditsaldo; de catalogusprijs van de leverancier in de bovenstaande tabel is wat de upstream-provider in rekening brengt voordat Okou het omzet in credits.
Beschikbaar op Okou sinds August 12, 2026.

