כל המודלים

DeepSeek V4 Flash ב-Okou. קידוד ברמת סוכן בשכבת המחיר הזולה ביותר

מודל DeepSeek's open-weight 284B Mixture-of-Experts עם 13B פעילים לכל אסימון. בניית 0731 מנצחת את V4 Pro בכל מדד סוכן ש-DeepSeek פרסמה, במחיר של $0.14 / $0.28 למיליון אסימונים.

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Flash הוא החצי היעיל של הדור הרביעי של DeepSeek: מודל Mixture-of-Experts עם 284 מיליארד פרמטרים המפעיל 13 מיליארד פרמטרים לכל אסימון, שוחרר תחת רישיון MIT עם משקלים פתוחים. בניית 0731 שנשלחה ב-31 ביולי 2026 שמרה על הארכיטקטורה ללא שינוי והריצה מחדש אימון לאחר אימון על נתוני סוכנים, מה שהעביר אותה מעבר ל-DeepSeek V4 Pro (תצוגה מקדימה) בכל תשעת מדדי הביצועים של הסוכנים ש-DeepSeek פרסמה – 82.7 לעומת 72.1 ב-Terminal-Bench 2.1, ו-54.4 לעומת 12.8 ב-DeepSWE.

מחיר המחירון של הספק הוא 0.14 דולר / 0.28 דולר למיליון אסימונים, עם פגיעות מטמון ב-0.0028 דולר / מיליון וללא חיוב על כתיבות מטמון, מה שהופך אותו למודל החשיבה הזול ביותר במערך הנוכחי של Okou. הוא נושא חלון הקשר של מיליון אסימונים, עד 384K פלט, ומצב חשיבה מופעל כברירת מחדל. הוא מבוסס טקסט בלבד: ללא ראייה. השתמש ב-Claude Sonnet 4.6 כאשר שלב דורש תמונות או את מסגרת Claude Code, וב-GPT 5.6 Luna כאשר אתה רוצה את הרמה הזולה של משפחת OpenAI במקום זאת.

מה זה DeepSeek V4 Flash?

31 ביולי 2026 (DeepSeek-V4-Flash-0731, בטא ציבורית) · החצי היעיל של משפחת DeepSeek V4: 13B פרמטרים פעילים לעומת 49B של V4 Pro, לאחר אימון לעבודת סוכן.

DeepSeek V4 Flash הופיע לראשונה ב-24 באפריל 2026 כמחצית הקטנה יותר של משפחת V4 — MoE עם 284B פרמטרים, 13B פעילים לכל טוקן וחלון הקשר של 1M טוקנים, לצד V4 Pro עם 1.6T פרמטרים. הוא יצא מתצוגה מקדימה ב-31 ביולי 2026 כ-DeepSeek-V4-Flash-0731, בניית בטא ציבורית ששמרה על הארכיטקטורה ללא שינוי והריצה מחדש רק את שלב הפוסט-אימון, הפעם על נתונים בטעם סוכן.

האימון מחדש הזה הוא כל הסיפור של הגרסה. לפי המספרים של DeepSeek עצמה, בניית 0731 מנצחת את V4 Pro (תצוגה מקדימה) בכל תשעת מדדי הסוכנים שפורסמו תוך הפעלת כרבע מהפרמטרים: Terminal-Bench 2.1 עולה מ-61.8 בתצוגה המקדימה של Flash ל-82.7, DeepSWE מ-7.3 ל-54.4, Toolathlon-Verified מ-49.7 ל-70.3. כמה מהם נוחתים בטווח של כמה נקודות מ-Claude Opus 4.8 — 82.7 לעומת 85.0 ב-Terminal-Bench 2.1, 25.2 לעומת 25.7 ב-Agents' Last Exam — בשבריר מהמחיר.

יש לציין את הסייגים בבירור. כל ציון מדווח על ידי DeepSeek ורץ עם DeepSeek Harness, שטרם שוחרר, כך שאף אחד מהם לא שוחזר באופן עצמאי, ושתיים מתוך תשע הקבוצות הן פנימיות של DeepSeek. המודל הוא טקסט בלבד, מפגר אחרי החזית בחשיבה ברמת בוגר, ועדיין מפגר אחרי V4 Pro במשימות מרובות שלבים ארוכות טווח. מצב חשיבה מופעל כברירת מחדל, וטוקני חשיבה מחויבים כפלט.

מה מיוחד ב-DeepSeek V4 Flash

ארכיטקטורת כותרות ותכונות יכולת.

V4 Flash הוא מודל Mixture-of-Experts דליל: 284B פרמטרים בסך הכל עם 13B מופעלים לכל אסימון, כאשר כל שכבת MoE מכילה מומחה משותף אחד ו-256 מומחים מנותבים בממד ביניים של 2048, ו-6 מומחים מנותבים מופעלים לכל אסימון. שלוש שכבות ה-MoE הראשונות משתמשות בניתוב גיבוב, ועומק חיזוי מרובה אסימונים הוא 1. נקודת הבדיקה 0731 שפורסמה היא 304B פרמטרים מכיוון שהיא שולחת מודול טיוטה של פענוח ספקולטיבי בנוסף לבסיס 284B. היא תומכת בחלון הקשר של 1M אסימונים עם עד 384K פלט, מצבי חשיבה ולא חשיבה, ופרמטר reasoning_effort עם רמות low, high ו-max. המשקלים ברישיון MIT ואינם מגודרים.

מפרטים במבט חטוף

משפחהסדרת DeepSeek V4 (פלאש)
פרמטרים284B סה"כ / 13B פעילים (MoE)
אופנויותטקסט, קוד (ללא ראייה)
רישיוןMIT, משקלים פתוחים
שמירת מטמון של הנחיותנתמך (DeepSeek)
חלון הקשרמיליון טוקנים
פלט מקסימליעד 384K אסימונים
מאמץ חשיבהנמוך / גבוה / מקסימלי
מחיר מחירון ספק0.14 דולר קלט / 0.28 דולר פלט למיליון

מדדי ביצועים של DeepSeek V4 Flash

נתונים שדווחו על ידי DeepSeek מכרטיס המודל DeepSeek-V4-Flash-0731, שהופעלו עם DeepSeek Harness במצב מינימלי במאמץ חשיבה מרבי (טמפרטורה 1.0, top_p 0.95). ה-Harness לא שוחרר, ולכן אף אחד מהנתונים הללו לא שוחזר באופן עצמאי, ו-DSBench-FullStack ו-DSBench-Hard הם מערכי הבדיקה הפנימיים של DeepSeek.

Terminal-Bench 2.1עבודת טרמינל סוכנתית; V4 Pro (תצוגה מקדימה) 72.1
82.7
SWE-bench מאומתבניית תצוגה מקדימה, דווחה על ידי הספק
79.0%
Cybergymדווח על ידי ספק
76.7
Toolathlon (מאומת)שימוש בכלי; V4 Pro (תצוגה מקדימה) 55.9
70.3
DSBench-FullStackסט פנימי של DeepSeek
68.7
DSBench-Hardסט פנימי של DeepSeek
59.6
DeepSWEעלייה מ-7.3 בבניית התצוגה המקדימה
54.4
NL2Repoבניית מאגר
54.2
המבחן האחרון של הסוכניםClaude Opus 4.8 משיג 25.7
25.2

תמחור DeepSeek V4 Flash

מחיר מחירון ספק, למיליון טוקנים.

קלט$0.14
פלט$0.28
קריאת מטמון$0.003
כתיבת מטמוןלא חויב

כיצד DeepSeek V4 Flash מתנהג בפועל

התנהגות נצפית מהרצות סוכנים בייצור.

ביצוע סוכנותי

מטרות האימון שלאחר 0731 מכוונות בדיוק לכך: הפעלת מסוף, קריאת כלים ברצף וסיום משימה ללא התערבות אנושית. 82.7 ב-Terminal-Bench 2.1 ו-70.3 ב-Toolathlon-Verified מציבים אותו בחברה מובילה ביחס למחיר.

פרופיל עלות

0.14 דולר / 0.28 דולר למיליון אסימונים, פגיעות מטמון ב-0.0028 דולר / מיליון, וכתיבות מטמון אינן מחויבות כלל. זו העמדה הזולה ביותר במערך הנוכחי ובערך שליש ממחיר הפלט של V4 Pro, אז זה המודל להצביע עליו לעבודה בנפח גבוה.

הקשר ארוך

מיליון אסימונים פנימה ועד 384 אלף אסימונים החוצה, כך שקריאה ברמת מאגר נתונים ותמלילים ארוכים מתאימים ללא חלוקה. האיכות בלולאות סוכנים ארוכות טווח ורבות שלבים עדיין מפגרת אחרי V4 Pro.

עומק חשיבה

ארבע רמות reasoning_effortlow, high ו-max — מחליפות זמן אחזור בתכנון, והציונים שפורסמו של DeepSeek כולם ב-max. חשיבה ברמת בוגר אינה החוזקה שלה; שם Claude Opus 5 ו-GPT 5.6 Sol נשארים לפני.

אופנויות

טקסט וקוד בלבד. כל דבר עם צילום מסך, PDF סרוק או תרשים בלולאה דורש מודל ראייה כגון Claude Sonnet 4.6 או GPT 5.6 Luna.

משימות סוכן הטובות ביותר עבור DeepSeek V4 Flash

סוכני קידוד בנפח גבוה

סקירת PR בכמות גדולה, כתיבת בדיקות, מעברי lint-and-fix ורפקטורים מתוזמנים, כאשר אותו סוכן רץ מאות פעמים ביום. בעלות של 0.28 דולר למיליון אסימוני פלט, עלות ההרצה נשארת נמוכה מספיק כך שהנפח מפסיק להיות האילוץ.

אוטומציה מונעת מסוף וכלים

התוצאות המפורסמות החזקות ביותר של בניית 0731 הן על עבודת מסוף ושימוש בכלים, וזה בדיוק מה שסוכן תיקון בנייה, בדיקת פריסה או מיון יומנים עושה כל היום.

קריאה ברחבי המאגר

חלון של מיליון אסימונים לוקח מאגר שלם בגודל בינוני, ציר זמן ארוך של אירוע או סט מלא של מסמכי עיצוב במעבר אחד, כך שסוכן הגירה או ביקורת יכול לחשוב על כל העניין במקום על פי חתיכות.

השכבה הזולה מתחת למתזמר חזיתי

תן ל-Claude Opus 5 או GPT 5.6 Sol לתכנן ולסקור, והעבר את השלבים המכניים הרבים – קריאת קבצים, הפעלת פקודות, ניסוח תיקונים – ל-V4 Flash. אתה משלם את התעריף הגבוה ביותר רק על השלבים שמחליטים את ההרצה.

מתי לדלג על DeepSeek V4 Flash

דלג על V4 Flash בכל דבר עם תמונות בלולאה, מכיוון שאין לו ראייה, ועל חשיבה ברמת בוגר, שם מודלי החזית עדיין מובילים בבירור. ריצות ארוכות טווח שנשארות קוהרנטיות במשך שעות רבות נשארות הטריטוריה של V4 Pro ו-Claude Opus. והתייחס לציוני הסוכנים שפורסמו כטענות ספק עד ש-DeepSeek Harness יישלח: בצע עליהם בדיקות ביצועים במאגר שלך לפני שתעביר סוכן ייצור.

DeepSeek V4 Flash לעומת מודלים אחרים

DeepSeek V4 Flash לעומת DeepSeek V4 Pro

אותה משפחה, סחר הפוך. Pro הוא ספינת הדגל של 1.6T עם 49B פעילים לכל טוקן; Flash מפעיל 13B ורשום בשליש ממחיר הפלט של Pro. במבחני הסוכנים שפורסמו של DeepSeek, בניית ה-Flash 0731 משיגה כעת ציון גבוה יותר מ-V4 Pro (תצוגה מקדימה) בכל תשעת המבחנים, כך שהמקרה עבור Pro הוא עומק בחשיבה ארוכה מרובת שלבים ולא תפוקת סוכנים. V4 Pro אינו מוצע עוד ב-Okou – העמוד שלו כאן הוא חומר עזר.

DeepSeek V4 Flash לעומת GPT 5.6 Luna

שניהם הם הרמה הזולה במשפחתם ושניהם פועלים על מסגרת Codex. לונה היא מולטימודלית ומגובה על ידי האקוסיסטם של OpenAI; פלאש הוא טקסט בלבד, בעל משקל פתוח, מחירו פחות מרבע ממחיר הפלט של לונה, ומציג ציוני בנצ'מרק סוכנים חזקים בהרבה. בחרו בלונה כאשר אתם זקוקים לראייה או להתנהגות ספציפית ל-OpenAI, בפלאש כאשר העבודה היא קוד וכלים.

DeepSeek V4 Flash לעומת Claude Sonnet 4.6

Sonnet 4.6 הוא מודל סוכן ליבה עם ראייה, מסגרת Claude Code ואמינות ניתוב הכלים של Anthropic; Flash הוא מודל חיסכון בעלויות, טקסט בלבד, במחיר של בערך חמישית ממחיר הפלט של Sonnet. שמרו את Sonnet על השלבים שמחליטים על ריצה ותנו ל-Flash את הנפח שמתחתיו.

שורה תחתונה: האם כדאי להשתמש ב-DeepSeek V4 Flash?

DeepSeek V4 Flash היא הדרך הזולה ביותר להפעיל סוכן קידוד מוכשר ב-Okou: מדדי סוכן קרובים לגבול, חלון של 1M טוקנים, ו-$0.28 לכל 1M טוקני פלט. ודא את מספרי הספק במאגר שלך, שמור את הראייה וההיגיון הקשה ביותר במקום אחר, וקשה לנצח אותו בעלות למשימה שהושלמה.

שאלות נפוצות

מהו חלון ההקשר של DeepSeek V4 Flash?

מיליון אסימונים פנימה, ועד 384 אלף אסימונים של פלט לכל תגובה. DeepSeek ממליץ על תקרת פלט מלאה של 384 אלף ב-high וברמות מאמץ ההיגיון של max.

כמה עולה DeepSeek V4 Flash?

מחיר מחירון הספק הוא 0.14 דולר למיליון אסימוני קלט ו-0.28 דולר למיליון פלט, עם פגיעות מטמון ב-0.0028 דולר למיליון וללא חיוב על כתיבות מטמון. ב-Okou הוא נמצא ברמת המחיר $, הזולה מבין הארבע. DeepSeek הודיעה על מדיניות שעות שיא שתכפיל את מחירי המחירון שלה בין השעות 09:00-12:00 ו-14:00-18:00 שעון בייג'ינג; היא עדיין לא נכנסה לתוקף.

האם DeepSeek V4 Flash טוב יותר מ-DeepSeek V4 Pro?

בתשעת מדדי הסוכנים ש-DeepSeek פרסמה עבור בניית 0731, כן: הוא מקבל ציון גבוה יותר מ-V4 Pro (תצוגה מקדימה) בכל אחד מהם, תוך הפעלת 13B פרמטרים לעומת 49B של Pro. Pro שומר על היתרון בחשיבה רב-שלבית ארוכת טווח. V4 Pro אינו מוצע עוד ב-Okou.

האם DeepSeek V4 Flash תומך בראייה?

לא. זה לוקח טקסט וקוד בלבד. נתב שלבים מבוססי צילום מסך, תרשים או PDF למודל רב-מודאלי כגון Claude Sonnet 4.6 או GPT 5.6 Luna.

באיזו מסגרת משתמש DeepSeek V4 Flash ב-Okou?

Codex. Okou מנתב אותו דרך DeepSeek's Responses API, ש-V4 Flash הוא כרגע המודל היחיד של DeepSeek שתומך בו. הפעל אותו כמודל מובנה המחויב בזיכויים של Okou, או הבא מפתח API משלך של DeepSeek.

חלופות

שימוש ב-DeepSeek V4 Flash ב-Okou

שתי דרכים לגשת ל-DeepSeek V4 Flash ב-Okou

Okou תומך ב-DeepSeek V4 Flash כמודל מובנה המחויב בזיכויים של Okou, ודרך הבאת מודל משלך עם DeepSeek API key. הנתיב המובנה משתמש בניתוב מנוהל של Okou וברמת המחיר המוסברת להלן; הנתיב של הבאת מודל משלך מחייב אותך ישירות מול הספק העליון ומדלג לחלוטין על המרת הזיכויים של Okou.

המלצת Okou

Okou ממקם את DeepSeek V4 Flash כאפשרות חסכונית לסיווג בכמויות גדולות, סינונים מקדימים, תגובות רגישות להשהיה ועבודות אחרות בנפח גבוה.

קרדיטים ורמת המחיר של $

Okou מתמחר כל מודל מובנה בסולם קרדיטים בן ארבעה שלבים – $, $$, $$$, $$$$ – המוצג כתג בבורר המודלים ובשורה price tier של zero model ls. DeepSeek V4 Flash נמצא ב-$. רמה זו היא מה שאתה מוציא מיתרת הקרדיטים שלך ב-Okou; מחיר המחירון של הספק בטבלה לעיל הוא מה שהספק העליון גובה לפני ש-Okou ממיר אותו לקרדיטים.

זמין ב-Okou מאז July 31, 2026.