Wszystkie modele

GPT-5.4 Mini: kompaktowy model rozumowania OpenAI

Zoptymalizowany pod kątem kosztów członek rodziny GPT-5 firmy OpenAI. ×0,3 kredytu, multimodalne widzenie i wystarczająco szybki do routingu o dużej objętości, klasyfikacji i wstępnego filtrowania.

400K tokens · Text / Vision / Code · Prompt cache

Okou nie uruchamia już GPT-5.4 Mini. Ta strona jest zachowana jako odniesienie do jej specyfikacji, cen i benchmarków. Do tego samego rodzaju pracy użyj GPT 5.6 Luna.

Zobacz GPT 5.6 Luna

GPT-5.4 Mini to oszczędny członek rodziny GPT-5 OpenAI — ten, po który sięgasz, gdy koszt jednostkowy jest ważniejszy niż szczytowa jakość rozumowania. Zachowuje okno kontekstowe 400K i multimodalne wejścia reszty rodziny, ale zmniejsza moc obliczeniową na token, co przekłada się na niższą cenę (0,75 USD / 4,5 USD za 1M) i zauważalnie wyższą prędkość.

Czym jest GPT-5.4 Mini?

Kwiecień 2026 · Wariant rodziny GPT-5 oszczędzający koszty. Odpowiednik Kimi K2.7 Code po stronie OpenAI.

GPT-5.4 Mini to zoptymalizowany pod względem kosztów członek generacji GPT-5 firmy OpenAI, wydany w kwietniu 2026 roku wraz z GPT-5.5 i GPT-5.4. OpenAI pozycjonuje go jako warstwę o wysokiej przepustowości — model, który utrzymujesz w działaniu w krokach klasyfikacji, routingu i wstępnego filtrowania, gdzie większe 5.4 lub 5.5 byłyby marnowane na rutynowe decyzje.

Architektonicznie dzieli okno kontekstowe 400K tokenów rodziny GPT-5, parametr reasoning_effort, buforowanie promptów i powierzchnię API odpowiedzi, której domyślnie używa kodeks CLI. Kompromisem w stosunku do 5.4 jest głębia rozumowania: Mini dobrze radzi sobie ze standardowymi wywołaniami narzędzi, krótkimi podsumowaniami i obciążeniami z wyjściem strukturalnym, ale zaczyna się gubić w trudniejszych, wieloetapowych planach, gdzie 5.4 nadal się sprawdza. Kompromisem w stosunku do konkurentów w tej samej cenie jest ekosystem — jeśli już korzystasz z Codex, pozostanie w obrębie powierzchni OpenAI zapewnia spójność definicji narzędzi i schematów wyjścia strukturalnego.

Co jest godne uwagi w GPT-5.4 Mini

Architektura nagłówków i funkcje możliwości.

GPT-5.4 Mini wykorzystuje tę samą architekturę co reszta rodziny GPT-5: okno kontekstowe 400K tokenów, parametr reasoning_effort na czterech poziomach, buforowanie promptów, gdzie buforowane dane wejściowe są rozliczane po jednej dziesiątej stawki wejściowej, oraz powierzchnia Responses API. Obsługiwane są użycie narzędzi, ustrukturyzowane dane wyjściowe i multimodalne dane wejściowe wizyjne. Model jest mniejszym, szybszym rodzeństwem — mniej parametrów na token, większa przepustowość na dolara.

Specyfikacje w skrócie

RodzinaGenerowanie GPT-5
ModalnościTekst, wizja, kod
JęzykiAngielski jako pierwszy, wielojęzyczny
Buforowanie promptówObsługiwane (OpenAI)
Okno kontekstowe400K tokenów
Maksymalne wyjścieDo 128 tys. tokenów
Wysiłek rozumowaniaMinimalny / Niski / Średni / Wysoki
Cena katalogowa dostawcy0,75 USD wejście / 4,5 USD wyjście za 1M

Benchmarki GPT-5.4 Mini

Wyniki zgłoszone przez dostawcę z materiałów prasowych OpenAI GPT-5 Mini. Niezależne recenzje umieszczają 5.4 Mini w tej samej kategorii oszczędności kosztów co Kimi K2.7 Code w większości testów porównawczych agentów. Traktuj bezwzględne wartości procentowe jako orientacyjne.

SWE-bench Verifiedzgłoszone przez dostawcę
~60%
Terminal-Bench 2.0użycie narzędzia zgłoszone przez dostawcę
~42%
AIME 2025 (bez narzędzi)matematyka konkurencji zgłoszona przez dostawcę
~84%
GPQA Diamondnauki ścisłe dla absolwentów zgłoszone przez dostawcę
~74%
PrędkośćSztuczna analiza, średni wysiłek
~165 tokenów/sek

Cennik GPT-5.4 Mini

Cena katalogowa dostawcy, za 1M tokenów.

Wejście$0.75
Wyjście$4.50
Odczyt pamięci podręcznej$0.07
Zapis pamięci podręcznejNie naliczono

Jak GPT-5.4 Mini zachowuje się w praktyce

Obserwowane zachowanie z uruchomień agentów produkcyjnych.

Prędkość

Najszybszy model w rodzinie GPT-5 — około 165 tokenów/sekundę przy średnim wysiłku według Artificial Analysis. To właśnie ta właściwość sprawia, że jest on wykonalny dla interaktywnych odpowiedzi na czacie i krótkich wywołań narzędzi typu fan-out, gdzie dominuje opóźnienie widoczne dla użytkownika.

Rutynowe wywołania narzędzi

Dokładny w standardowym katalogu narzędzi Codex. Tam, gdzie 5.4 wyprzedza, to trudne przypadki brzegowe (warunkowy wybór narzędzi, głęboko zagnieżdżone argumenty) — w rutynowych przypadkach Mini obsługuje routing narzędzi czysto za jedną trzecią kosztów.

Klasyfikacja masowa i wstępne filtrowanie

Najlepsza pozycja kosztowo-jakościowa w rodzinie GPT-5 dla prac rozproszonych. Masowe sortowanie PR, kategoryzacja zgłoszeń serwisowych, klasyfikacja dokumentów – wszystkie obciążenia, dla których wcześniej ręcznie tworzono wyrażenia regularne, są teraz przystępne cenowo w rzeczywistym wywołaniu modelu.

Efektywność kosztowa

0,3 kredytu z włączoną wizją multimodalną. Mini i Kimi K2.7 Code znajdują się w tym samym przedziale, podczas gdy DeepSeek V4 Pro jest niżej, na poziomie 0,1 — wybór zazwyczaj zależy od dopasowania do frameworka i zachowania w konkretnym obciążeniu.

Kiedy eskalować

Mini dryfuje na długich, wieloetapowych planach, trudnym rozumowaniu i pierwszych próbach edycji kodu wielu plików. Zbuduj agenta tak, aby orkiestrator decydował, kiedy eskalować do 5.4 lub 5.5, a nie tak, aby Mini próbował wykonać całą pętlę.

Najlepsze zadania agenta dla GPT-5.4 Mini

Klasyfikator rozgałęziający, który działa przy każdym zdarzeniu

Przychodzący zgłoszenie wsparcia, komentarz do PR, transkrypcja rozmowy sprzedażowej, przesłany dokument — Mini czyta każdy z nich i kieruje go do odpowiedniego agenta lub recenzenta. 0,3 kredytu i 165 tokenów/sekundę oznaczają, że koszt na zdarzenie jest na tyle niski, że uruchamianie go dla każdego zdarzenia (nie tylko dla próbek) jest faktycznie wykonalne.

Krok wstępnego filtrowania przed drogim modelem

Przypnij Mini na górze wywołania narzędzia agenta, aby zdecydował, czy żądanie w ogóle wymaga eskalacji. Większość żądań otrzymuje szybką i tanią odpowiedź; tylko resztkowa mniejszość płaci pełny koszt GPT-5.4 lub 5.5. To tutaj łączenie warstw oszczędnościowych i podstawowych naprawdę zmienia to, co jest przystępne cenowo.

Interaktywna odpowiedź na czacie

Krótkie, multimodalne tury, w których dominującym doświadczeniem jest widoczne dla użytkownika opóźnienie. Mini odpowiada wystarczająco szybko, aby strumieniowanie wydawało się natychmiastowe, a obsługa multimodalna oznacza, że zrzut ekranu w rozmowie po prostu działa.

Kiedy pominąć GPT-5.4 Mini

Pomiń GPT-5.4 Mini w przypadku najtrudniejszych zadań rozumowania, wieloetapowej orkiestracji agentów, sekwencji użycia komputera i pierwszych prób edycji kodu w wielu plikach — eskaluj do 5.4 dla rutynowych wersji tych zadań i do 5.5 dla najtrudniejszych.

GPT-5.4 Mini vs inne modele

GPT-5.4 Mini vs GPT-5.4

Ta sama rodzina, inne pozycjonowanie. 5.4 Mini (×0.3) wygrywa pod względem kosztów i szybkości; 5.4 (×1) wygrywa pod względem jakości rozumowania i dokładności routingu narzędzi w trudnych przypadkach. Standardowy wzorzec to wstępne filtrowanie za pomocą Mini i eskalowanie pozostałych przypadków do 5.4.

GPT-5.4 Mini vs Claude Sonnet 4.6

Claude Sonnet 4.6 jest aktualnym celem porównawczym katalogu dla tego modelu.

Podsumowując: czy powinieneś używać GPT-5.4 Mini?

GPT-5.4 Mini jest domyślnym modelem oszczędzającym koszty po stronie OpenAI. Wstępnie filtruj za pomocą Mini, eskaluj do GPT-5.4 dla rutynowych kroków, eskaluj do GPT-5.5 tylko dla najtrudniejszych rozumowań.

Często zadawane pytania

Jakie jest okno kontekstowe GPT-5.4 Mini?

400 000 tokenów, z maksymalnie 128 tys. tokenów wyjściowych na odpowiedź — tak samo jak reszta rodziny GPT-5.

Czy GPT-5.4 Mini obsługuje obrazy?

Tak. Podobnie jak reszta rodziny GPT-5, akceptuje obrazy jako dane wejściowe wraz z tekstem i kodem.

Kiedy powinienem wybrać GPT-5.4 Mini zamiast Kimi K2.7 Code?

Gdy Twój agent jest już zbudowany na frameworku Codex lub potrzebujesz ekosystemu OpenAI do strukturyzowanych danych wyjściowych/wywołań narzędzi. Oba kosztują 0,3 kredytu, więc koszt jest identyczny, a wybór zależy od frameworku i zachowania.

Czy GPT-5.4 Mini obsługuje buforowanie promptów?

Tak. Buforowane dane wejściowe są rozliczane po 0,075 USD za 1 milion tokenów — 10-krotna zniżka na buforowaną część.

Alternatywy

Dostępność GPT-5.4 Mini na Okou

GPT-5.4 Mini został usunięty z oferty Okou, więc nie można go już wybrać w czacie ani w przepływie pracy, i nie jest dostępny z własnym kluczem API. GPT 5.6 Luna obejmuje ten sam poziom oszczędności kosztów.