GPT-5.4 Mini: מודל ההיגיון הקומפקטי של OpenAI
החבר החסכוני של OpenAI ממשפחת GPT-5. ×0.3 קרדיטים, ראייה מולטימודלית, ומהיר מספיק לניתוב בנפח גבוה, סיווג ועבודת סינון מקדים.
400K tokens · Text / Vision / Code · Prompt cache
Okou אינו מריץ עוד את GPT-5.4 Mini. דף זה נשמר כהפניה למפרטיו, תמחורו ובנצ'מרקים שלו. עבור אותו סוג עבודה, השתמש ב-GPT 5.6 Luna.
ראה GPT 5.6 LunaGPT-5.4 Mini הוא החבר החסכוני במשפחת GPT-5 של OpenAI — זה שאתה משתמש בו כשעלות היחידה חשובה יותר מאיכות ההיגיון המרבית. הוא שומר על חלון ההקשר של 400K ועל קלטים מולטימודליים של שאר המשפחה, אך מקצץ את החישוב לכל אסימון, מה שמתורגם למחיר נמוך יותר (0.75$ / 4.5$ למיליון) ומהירות גבוהה יותר באופן ניכר.
מה זה GPT-5.4 Mini?
אפריל 2026 · גרסה חסכונית של משפחת GPT-5. העמית בצד OpenAI של Kimi K2.7 Code.
GPT-5.4 Mini הוא החבר האופטימלי מבחינת עלות של דור GPT-5 של OpenAI, ששוחרר באפריל 2026 לצד GPT-5.5 ו-GPT-5.4. OpenAI ממקמת אותו כרמת התפוקה הגבוהה – המודל שאתה ממשיך להפעיל בסיווג, ניתוב ושלבי סינון מקדים שבהם ה-5.4 או ה-5.5 הגדולים יותר יתבזבזו על החלטות שגרתיות.
מבחינה ארכיטקטונית, הוא חולק את חלון ההקשר של 400K אסימונים של משפחת GPT-5, את הפרמטר reasoning_effort, שמירת מטמון של הנחיות, ואת משטח Responses API ש-codex CLI משתמש בו כברירת מחדל. הפשרה לעומת 5.4 היא עומק ההיגיון: Mini מטפל היטב בקריאות כלים סטנדרטיות, סיכומים קצרים ועומסי עבודה עם פלט מובנה, אך מתחיל לסטות בתוכניות מרובות שלבים קשות יותר שבהן 5.4 עדיין מחזיק מעמד. הפשרה לעומת מתחרים באותה נקודת מחיר היא המערכת האקולוגית – אם אתם כבר משתמשים ב-Codex, הישארות בתוך משטח OpenAI שומרת על עקביות הגדרות הכלים וסכימות הפלט המובנה.
מה מיוחד ב-GPT-5.4 Mini
ארכיטקטורת כותרות ותכונות יכולת.
GPT-5.4 Mini משתמש באותה ארכיטקטורה כמו שאר משפחת GPT-5: חלון הקשר של 400K טוקנים, פרמטר reasoning_effort בארבע רמות, שמירת מטמון של הנחיות שבה קלט שמור מחויב בעשירית מקצב הקלט, ומשטח התגובות API. שימוש בכלים, פלטים מובנים וקלטי ראייה מולטימודליים נתמכים. המודל הוא אח קטן ומהיר יותר – פחות פרמטרים לטוקן, יותר תפוקה לדולר.
מפרטים במבט חטוף
מדדי ביצועים של GPT-5.4 Mini
ציונים שדווחו על ידי הספק מחומרי ההשקה של GPT-5 Mini של OpenAI. סקירות עצמאיות מציבות את 5.4 Mini באותה רצועת חיסכון בעלויות כמו Kimi K2.7 Code ברוב מדדי הסוכנים. התייחס לאחוזים מוחלטים ככיווניים.
תמחור GPT-5.4 Mini
מחיר מחירון ספק, למיליון טוקנים.
כיצד GPT-5.4 Mini מתנהג בפועל
התנהגות נצפית מהרצות סוכנים בייצור.
מהירות
המודל המהיר ביותר במשפחת GPT-5 – בסביבות 165 אסימונים/שנייה במאמץ בינוני לפי Artificial Analysis. זו התכונה שהופכת אותו לבר-קיימא עבור תגובות צ'אט אינטראקטיביות וקריאות כלים קצרות עם פיצול שבהן השהיה הנראית למשתמש שולטת.
קריאות כלים שגרתיות
מדויק בקטלוג הכלים הסטנדרטי של Codex. היכן ש-5.4 מתקדם הוא במקרי קצה קשים (בחירת כלים מותנית, ארגומנטים מקוננים עמוק) – עבור המקרים השגרתיים Mini מטפל בניווט כלים בצורה נקייה בשליש מהעלות.
סיווג וסינון מקדים בכמות גדולה
עמדת עלות/איכות החזקה ביותר במשפחת GPT-5 לעבודת פיזור. מיון PR בכמות גדולה, סיווג כרטיסי תמיכה, סיווג רמות מסמכים – כל עומסי העבודה שבהם היית בעבר מגלגל ביד ביטויים רגולריים זמינים כעת במחיר סביר בקריאת מודל אמיתית.
יעילות עלות
×0.3 קרדיטים כולל ראייה מולטימודלית. Mini ו-Kimi K2.7 Code נמצאים באותה רמה, בעוד DeepSeek V4 Pro נמצא נמוך יותר ב-×0.1 — הבחירה בדרך כלל מסתכמת בהתאמת המסגרת ובהתנהגות בעומס העבודה הספציפי שלך.
מתי להסלים
מיני נוטה לסטות בתוכניות ארוכות מרובות שלבים, בהיגיון קשה ובעריכות קוד מרובות קבצים בניסיון ראשון. בנה את הסוכן כך שהמתזמן יחליט מתי להסלים ל-5.4 או 5.5, ולא שמיני ינסה לבצע את כל הלולאה.
משימות סוכן הטובות ביותר עבור GPT-5.4 Mini
מסווג הפיזור שרץ על כל אירוע
כרטיס תמיכה נכנס, תגובת PR, תמלול שיחת מכירה, העלאת מסמך — מיני קורא כל אחד מהם ומנתב אותו לסוכן המתאים במורד הזרם או למבקר אנושי. 0.3 קרדיטים ו-165 טוקנים/שנייה פירושם שעלות האירוע קטנה מספיק כדי שהפעלתו בכל אירוע (לא רק באצוות מדגמיות) תהיה למעשה כדאית.
שלב הסינון המקדים לפני המודל היקר
הצמד את Mini בראש קריאת הכלי של הסוכן כדי שיחליט אם הבקשה בכלל צריכה להסלים. רוב הבקשות מקבלות תשובה מהירה וזולה; רק המיעוט הנותר משלם את העלות המלאה של GPT-5.4 או 5.5. כאן ערימת שכבות חיסכון בעלויות ושכבות ליבה משנה באמת את מה שניתן להרשות לעצמו.
תגובת הצ'אט האינטראקטיבית
תורות מולטימודליים קצרים שבהם השהיה הנראית למשתמש שולטת בחוויה. מיני עונה מהר מספיק כדי שהזרמה תרגיש מיידית, והתמיכה המולטימודלית אומרת שצילום מסך בשיחה פשוט עובד.
מתי לדלג על GPT-5.4 Mini
דלגו על GPT-5.4 Mini בחשיבה הקשה ביותר, תזמור סוכנים מרובי שלבים, רצפי שימוש במחשב ועריכות קוד מרובות קבצים בניסיון ראשון — העלו ל-5.4 עבור גרסאות שגרתיות של משימות אלו ול-5.5 עבור הקשות ביותר.
GPT-5.4 Mini לעומת מודלים אחרים
GPT-5.4 Mini לעומת GPT-5.4
אותה משפחה, מיצוב שונה. 5.4 Mini (×0.3) מנצח בעלות ובמהירות; 5.4 (×1) מנצח באיכות ההסקה ובדיוק ניתוב הכלים במקרים קשים. התבנית הסטנדרטית היא לסנן מראש עם Mini ולהסלים מקרים שיוריים ל-5.4.
GPT-5.4 Mini לעומת Claude Sonnet 4.6
Claude Sonnet 4.6 הוא יעד ההשוואה הנוכחי בקטלוג עבור מודל זה.
שורה תחתונה: האם כדאי להשתמש ב-GPT-5.4 Mini?
GPT-5.4 Mini הוא ברירת המחדל החסכונית בצד ה-OpenAI. סנן מראש עם Mini, הסלם ל-GPT-5.4 עבור שלבים שגרתיים, הסלם ל-GPT-5.5 רק עבור ההיגיון הקשה ביותר.
שאלות נפוצות
מהו חלון ההקשר של GPT-5.4 Mini?
400,000 אסימונים, עם עד 128K אסימונים של פלט לכל תגובה - זהה לשאר משפחת GPT-5.
האם GPT-5.4 Mini יכול לטפל בתמונות?
כן. כמו שאר משפחת GPT-5 הוא מקבל קלט תמונה לצד טקסט וקוד.
מתי עלי לבחור ב-GPT-5.4 Mini במקום ב-Kimi K2.7 Code?
כאשר הסוכן שלך כבר בנוי על מסגרת Codex או שאתה זקוק למערכת האקולוגית של פלט מובנה / קריאת כלים של OpenAI. שניהם עולים ×0.3 קרדיטים, כך שהעלות זהה והבחירה מסתכמת במסגרת ובהתנהגות.
האם GPT-5.4 Mini תומך בשמירת מטמון של הנחיות?
כן. קלט שמור במטמון מחויב ב-$0.075 למיליון אסימונים — הנחה של פי 10 על החלק השמור במטמון.
חלופות
זמינות GPT-5.4 Mini ב-Okou
GPT-5.4 Mini הוסר ממערך Okou, כך שלא ניתן עוד לבחור אותו בצ'אט או בתהליך עבודה, והוא אינו זמין עם מפתח API משלך. GPT 5.6 Luna מכסה את אותה רמת חיסכון בעלויות.

