Wszystkie modele

DeepSeek V4 Flash na Okou. Kodowanie na poziomie agenta w najtańszej warstwie cenowej

Model DeepSeek 284B Mixture-of-Experts o otwartym kodzie źródłowym z 13B aktywnymi tokenami. Kompilacja 0731 przewyższa V4 Pro we wszystkich testach agentów opublikowanych przez DeepSeek, w cenie 0,14 USD / 0,28 USD za 1 milion tokenów.

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash to wydajna część generacji V4 DeepSeek: model Mixture-of-Experts o 284 miliardach parametrów, który aktywuje 13 miliardów parametrów na token, wydany na licencji MIT z otwartymi wagami. Kompilacja 0731, która została wydana 31 lipca 2026 r., zachowała niezmienioną architekturę i ponownie uruchomiła post-trening na danych agentów, co przesunęło ją poza DeepSeek V4 Pro (Preview) we wszystkich dziewięciu opublikowanych przez DeepSeek benchmarkach agentów — 82,7 w porównaniu do 72,1 w Terminal-Bench 2.1 i 54,4 w porównaniu do 12,8 w DeepSWE.

Cena katalogowa dostawcy to 0,14 USD / 0,28 USD za 1 milion tokenów, z trafieniami w pamięci podręcznej po 0,0028 USD / 1 milion i bez opłat za zapisy do pamięci podręcznej, co czyni go najtańszym modelem rozumowania w obecnej ofercie Okou. Posiada okno kontekstowe o rozmiarze 1 miliona tokenów, do 384 tys. wyjścia i domyślnie włączony tryb myślenia. Jest tylko tekstowy: brak wizji. Sięgnij po Claude Sonnet 4.6, gdy krok wymaga obrazów lub frameworka Claude Code, a po GPT 5.6 Luna, gdy chcesz tańszej warstwy rodziny OpenAI.

Czym jest DeepSeek V4 Flash?

31 lipca 2026 (DeepSeek-V4-Flash-0731, publiczna beta) · Wydajna połowa rodziny DeepSeek V4: 13B aktywnych parametrów w porównaniu do 49B w V4 Pro, po przeszkoleniu do pracy agenta.

DeepSeek V4 Flash po raz pierwszy pojawił się 24 kwietnia 2026 roku jako mniejsza część rodziny V4 — MoE o 284B parametrach z 13B aktywnymi na token i oknem kontekstowym 1M tokenów, obok V4 Pro o 1.6T parametrach. Zakończył fazę podglądu 31 lipca 2026 roku jako DeepSeek-V4-Flash-0731, publiczna wersja beta, która zachowała niezmienioną architekturę i ponownie uruchomiła tylko etap post-treningowy, tym razem na danych o smaku agentowym.

To ponowne szkolenie to cała historia wydania. Według własnych danych DeepSeek, kompilacja 0731 przewyższa V4 Pro (Preview) we wszystkich dziewięciu opublikowanych benchmarkach agentów, aktywując około jedną czwartą parametrów: Terminal-Bench 2.1 wzrasta z 61.8 w podglądzie Flash do 82.7, DeepSWE z 7.3 do 54.4, Toolathlon-Verified z 49.7 do 70.3. Kilka z nich ląduje w odległości kilku punktów od Claude Opus 4.8 — 82.7 wobec 85.0 na Terminal-Bench 2.1, 25.2 wobec 25.7 na Agents' Last Exam — za ułamek ceny.

Warto jasno określić zastrzeżenia. Każdy wynik jest zgłaszany przez DeepSeek i uruchamiany za pomocą DeepSeek Harness, który nie został jeszcze wydany, więc żaden z nich nie został niezależnie odtworzony, a dwa z dziewięciu zestawów to wewnętrzne zestawy DeepSeek. Model jest tylko tekstowy, pozostaje w tyle za czołówką w rozumowaniu na poziomie magisterskim i nadal ustępuje V4 Pro w długoterminowych, wieloetapowych zadaniach. Tryb myślenia jest domyślnie włączony, a tokeny myślenia są rozliczane jako dane wyjściowe.

Co jest godne uwagi w DeepSeek V4 Flash

Architektura nagłówków i funkcje możliwości.

V4 Flash to rzadki model Mixture-of-Experts: 284B całkowitych parametrów z 13B aktywowanych na token, gdzie każda warstwa MoE zawiera 1 wspólnego eksperta i 256 kierowanych ekspertów o pośrednim wymiarze 2048, a 6 kierowanych ekspertów uruchamia się na token. Pierwsze trzy warstwy MoE używają routingu haszującego, a głębokość przewidywania wielu tokenów wynosi 1. Opublikowany punkt kontrolny 0731 ma 304B parametrów, ponieważ zawiera moduł roboczy do spekulatywnego dekodowania na szczycie bazy 284B. Obsługuje okno kontekstowe 1M tokenów z wyjściem do 384K, tryby myślenia i niemyślenia oraz parametr reasoning_effort z poziomami low, high i max. Wagi są objęte licencją MIT i nie są bramkowane.

Specyfikacje w skrócie

RodzinaSeria DeepSeek V4 (Flash)
Parametry284B łącznie / 13B aktywnych (MoE)
ModalnościTekst, kod (bez wizji)
LicencjaMIT, otwarte wagi
Buforowanie promptówObsługiwane (DeepSeek)
Okno kontekstowe1M tokenów
Maksymalne wyjścieDo 384 tys. tokenów
Wysiłek rozumowaniaNiski / Wysoki / Maks
Cena katalogowa dostawcy0,14 USD wejście / 0,28 USD wyjście za 1M

Benchmarki DeepSeek V4 Flash

Dane zgłoszone przez DeepSeek z karty modelu DeepSeek-V4-Flash-0731, uruchomione z DeepSeek Harness w trybie minimalnym przy maksymalnym wysiłku rozumowania (temperatura 1.0, top_p 0.95). Uprząż nie została wydana, więc żadne z tych danych nie zostało niezależnie odtworzone, a DSBench-FullStack i DSBench-Hard to wewnętrzne zestawy testowe DeepSeek.

Terminal-Bench 2.1agentowa praca terminalowa; V4 Pro (podgląd) 72.1
82.7
SWE-bench Verifiedkompilacja podglądowa, zgłoszona przez dostawcę
79.0%
Cybergymzgłoszone przez dostawcę
76.7
Toolathlon (zweryfikowany)użycie narzędzi; V4 Pro (podgląd) 55.9
70.3
DSBench-FullStackWewnętrzny zestaw DeepSeek
68.7
DSBench-HardWewnętrzny zestaw DeepSeek
59.6
DeepSWEwzrost z 7.3 w wersji podglądowej
54.4
NL2Repobudowa repozytorium
54.2
Ostatni egzamin agentówClaude Opus 4.8 osiąga 25.7
25.2

Cennik DeepSeek V4 Flash

Cena katalogowa dostawcy, za 1M tokenów.

Wejście$0.14
Wyjście$0.28
Odczyt pamięci podręcznej$0.003
Zapis pamięci podręcznejNie naliczono

Jak DeepSeek V4 Flash zachowuje się w praktyce

Obserwowane zachowanie z uruchomień agentów produkcyjnych.

Agentowe wykonanie

Cel szkolenia 0731 jest dokładnie taki: obsługa terminala, sekwencyjne wywoływanie narzędzi i ukończenie zadania bez udziału człowieka. Wyniki 82.7 na Terminal-Bench 2.1 i 70.3 na Toolathlon-Verified plasują go w czołówce w tej cenie.

Profil kosztów

0,14 USD / 0,28 USD za 1 mln tokenów, trafienia w pamięci podręcznej za 0,0028 USD / 1 mln, a zapisy w pamięci podręcznej w ogóle nie są rozliczane. To najtańsza pozycja w obecnej ofercie i około jedna trzecia ceny wyjściowej V4 Pro, więc jest to model do wskazywania na prace o dużej objętości.

Długi kontekst

1M tokenów wejścia i do 384K wyjścia, więc czytanie całego repozytorium i długie transkrypcje mieszczą się bez dzielenia. Jakość w długoterminowych, wieloetapowych pętlach agentów nadal ustępuje V4 Pro.

Głębokość rozumowania

Trzy poziomy reasoning_effortlow, high i max — wymieniają opóźnienia na rozwagę, a opublikowane wyniki DeepSeek są wszystkie na max. Rozumowanie na poziomie absolwenta nie jest jego mocną stroną; to tam Claude Opus 5 i GPT 5.6 Sol pozostają w czołówce.

Modalności

Tylko tekst i kod. Wszystko, co zawiera zrzut ekranu, zeskanowany PDF lub wykres w pętli, wymaga modelu wizyjnego, takiego jak Claude Sonnet 4.6 lub GPT 5.6 Luna.

Najlepsze zadania agenta dla DeepSeek V4 Flash

Agenci kodujący o dużej objętości

Masowe przeglądy PR, pisanie testów, przechodzenie lint-and-fix i zaplanowane refaktoryzacje, gdzie ten sam agent działa setki razy dziennie. Przy 0,28 USD za 1 milion tokenów wyjściowych koszt pojedynczego uruchomienia pozostaje na tyle niski, że objętość przestaje być ograniczeniem.

Automatyzacja terminalowa i sterowana narzędziami

Najsilniejsze opublikowane wyniki kompilacji 0731 dotyczą pracy terminalowej i użycia narzędzi, co jest dokładnie tym, co agent do naprawy kompilacji, sprawdzania wdrożenia lub sortowania logów robi przez cały dzień.

Czytanie w całym repozytorium

Okno 1M tokenów pozwala na jednorazowe przetworzenie całego średniej wielkości repozytorium, długiej osi czasu incydentu lub pełnego zestawu dokumentów projektowych, dzięki czemu agent migracji lub audytu może rozumować nad całością, zamiast fragment po fragmencie.

Tania warstwa pod orkiestratorem granicznym

Pozwól Claude Opus 5 lub GPT 5.6 Sol zaplanować i przejrzeć, a wiele mechanicznych kroków — czytanie plików, uruchamianie poleceń, tworzenie poprawek — przekaż V4 Flash. Płacisz stawkę graniczną tylko za kroki, które decydują o przebiegu.

Kiedy pominąć DeepSeek V4 Flash

Pomiń V4 Flash we wszystkim, co zawiera obrazy w pętli, ponieważ nie ma wizji, oraz w rozumowaniu na poziomie magisterskim, gdzie modele graniczne nadal wyraźnie przodują. Długoterminowe przebiegi, które pozostają spójne przez wiele godzin, pozostają domeną V4 Pro i Claude Opus. A opublikowane wyniki agentów traktuj jako twierdzenia dostawcy, dopóki DeepSeek Harness nie zostanie wydany: przetestuj je w swoim własnym repozytorium, zanim przeniesiesz agenta produkcyjnego.

DeepSeek V4 Flash vs inne modele

DeepSeek V4 Flash vs DeepSeek V4 Pro

Ta sama rodzina, przeciwne kompromisy. Pro to flagowy model 1.6T z 49B aktywnymi na token; Flash aktywuje 13B i kosztuje jedną trzecią ceny wyjściowej Pro. W opublikowanych przez DeepSeek benchmarkach agentów, kompilacja 0731 Flash osiąga obecnie wyższe wyniki niż V4 Pro (Preview) we wszystkich dziewięciu, więc argumentem za Pro jest głębia w długim, wieloetapowym rozumowaniu, a nie przepustowość agenta. V4 Pro nie jest już oferowany na Okou — jego strona tutaj jest materiałem referencyjnym.

DeepSeek V4 Flash vs GPT 5.6 Luna

Oba są tanimi wersjami swoich rodzin i oba działają na frameworku Codex. Luna jest multimodalna i wspierana przez ekosystem OpenAI; Flash jest tylko tekstowy, o otwartej wadze, kosztuje mniej niż jedną czwartą ceny wyjściowej Luny i wykazuje znacznie silniejsze opublikowane wyniki benchmarków agentów. Wybierz Lunę, gdy potrzebujesz wizji lub zachowania specyficznego dla OpenAI, Flash, gdy praca dotyczy kodu i narzędzi.

DeepSeek V4 Flash vs Claude Sonnet 4.6

Sonnet 4.6 to podstawowy model agenta z wizją, frameworkiem Claude Code i niezawodnością routingu narzędzi Anthropic; Flash to oszczędny model tylko tekstowy, kosztujący około pięćdziesiątej ceny wyjściowej Sonnet. Zachowaj Sonnet na etapach, które decydują o przebiegu, a Flashowi daj objętość pod nim.

Podsumowując: czy powinieneś używać DeepSeek V4 Flash?

DeepSeek V4 Flash to najtańszy sposób na uruchomienie kompetentnego agenta kodującego na Okou: benchmarki agentów bliskie granicy, okno 1M tokenów i 0,28 USD za 1M tokenów wyjściowych. Zweryfikuj liczby dostawcy na własnym repozytorium, zachowaj wizję i najtrudniejsze rozumowanie gdzie indziej, a trudno będzie go przebić pod względem kosztu na ukończone zadanie.

Często zadawane pytania

Jakie jest okno kontekstowe DeepSeek V4 Flash?

1M tokenów wejściowych i do 384K tokenów wyjściowych na odpowiedź. DeepSeek zaleca pełny limit 384K wyjściowych tokenów na poziomach wysiłku rozumowania high i max.

Ile kosztuje DeepSeek V4 Flash?

Cena katalogowa dostawcy wynosi 0,14 USD za 1 milion tokenów wejściowych i 0,28 USD za 1 milion tokenów wyjściowych, z trafieniami w pamięci podręcznej po 0,0028 USD za 1 milion i bez opłat za zapisy w pamięci podręcznej. Na Okou znajduje się w przedziale cenowym $, najtańszym z czterech. DeepSeek ogłosił politykę godzin szczytu, która podwoiłaby jego własne ceny katalogowe między 09:00-12:00 a 14:00-18:00 czasu pekińskiego; jeszcze nie weszła w życie.

Czy DeepSeek V4 Flash jest lepszy niż DeepSeek V4 Pro?

Na dziewięciu benchmarkach agentów opublikowanych przez DeepSeek dla kompilacji 0731, tak: osiąga wyższe wyniki niż V4 Pro (Preview) na każdym z nich, aktywując 13B parametrów w porównaniu do 49B Pro. Pro utrzymuje przewagę w długoterminowym, wieloetapowym rozumowaniu. V4 Pro nie jest już oferowany na Okou.

Czy DeepSeek V4 Flash obsługuje wizję?

Nie. Przyjmuje tylko tekst i kod. Kroki oparte na zrzutach ekranu, wykresach lub PDF kieruj do modelu multimodalnego, takiego jak Claude Sonnet 4.6 lub GPT 5.6 Luna.

Jakiego frameworka używa DeepSeek V4 Flash na Okou?

Codex. Okou kieruje go przez DeepSeek's Responses API, który V4 Flash jest obecnie jedynym modelem DeepSeek obsługującym. Uruchom go jako wbudowany model rozliczany w kredytach Okou lub użyj własnego klucza DeepSeek API.

Alternatywy

Używanie DeepSeek V4 Flash na Okou

Dwa sposoby dostępu do DeepSeek V4 Flash na Okou

Okou obsługuje DeepSeek V4 Flash jako wbudowany model rozliczany w kredytach Okou oraz poprzez własne rozwiązanie z DeepSeek API key. Ścieżka wbudowana wykorzystuje zarządzane routowanie Okou i poziom cen wyjaśniony poniżej; ścieżka własna rozlicza Cię bezpośrednio z dostawcą nadrzędnym i całkowicie pomija konwersję kredytów Okou.

Rekomendacja Okou

Okou pozycjonuje DeepSeek V4 Flash jako opcję oszczędzającą koszty dla klasyfikacji masowej, wstępnych filtrów, odpowiedzi wrażliwych na opóźnienia i innych zadań o dużej objętości.

Kredyty i poziom cen $

Okou wycenia każdy wbudowany model w czterostopniowej skali kredytowej — $, $$, $$$, $$$$ — wyświetlanej jako odznaka w selektorze modeli i w wierszu price tier w zero model ls. DeepSeek V4 Flash znajduje się na $. Ten poziom to to, co wydajesz ze swojego salda kredytowego Okou; cena katalogowa dostawcy w powyższej tabeli to to, co pobiera dostawca nadrzędny, zanim Okou przeliczy to na kredyty.

Dostępne na Okou od July 31, 2026.