GPT-5.4 Mini: kompaktowy model rozumowania OpenAI
Zoptymalizowany pod kątem kosztów członek rodziny GPT-5 firmy OpenAI. ×0,3 kredytu, multimodalne widzenie i wystarczająco szybki do routingu o dużej objętości, klasyfikacji i wstępnego filtrowania.
400K tokens · Text / Vision / Code · Prompt cache
Okou nie uruchamia już GPT-5.4 Mini. Ta strona jest zachowana jako odniesienie do jej specyfikacji, cen i benchmarków. Do tego samego rodzaju pracy użyj GPT 5.6 Luna.
Zobacz GPT 5.6 LunaGPT-5.4 Mini to oszczędny członek rodziny GPT-5 OpenAI — ten, po który sięgasz, gdy koszt jednostkowy jest ważniejszy niż szczytowa jakość rozumowania. Zachowuje okno kontekstowe 400K i multimodalne wejścia reszty rodziny, ale zmniejsza moc obliczeniową na token, co przekłada się na niższą cenę (0,75 USD / 4,5 USD za 1M) i zauważalnie wyższą prędkość.
Czym jest GPT-5.4 Mini?
Kwiecień 2026 · Wariant rodziny GPT-5 oszczędzający koszty. Odpowiednik Kimi K2.7 Code po stronie OpenAI.
GPT-5.4 Mini to zoptymalizowany pod względem kosztów członek generacji GPT-5 firmy OpenAI, wydany w kwietniu 2026 roku wraz z GPT-5.5 i GPT-5.4. OpenAI pozycjonuje go jako warstwę o wysokiej przepustowości — model, który utrzymujesz w działaniu w krokach klasyfikacji, routingu i wstępnego filtrowania, gdzie większe 5.4 lub 5.5 byłyby marnowane na rutynowe decyzje.
Architektonicznie dzieli okno kontekstowe 400K tokenów rodziny GPT-5, parametr reasoning_effort, buforowanie promptów i powierzchnię API odpowiedzi, której domyślnie używa kodeks CLI. Kompromisem w stosunku do 5.4 jest głębia rozumowania: Mini dobrze radzi sobie ze standardowymi wywołaniami narzędzi, krótkimi podsumowaniami i obciążeniami z wyjściem strukturalnym, ale zaczyna się gubić w trudniejszych, wieloetapowych planach, gdzie 5.4 nadal się sprawdza. Kompromisem w stosunku do konkurentów w tej samej cenie jest ekosystem — jeśli już korzystasz z Codex, pozostanie w obrębie powierzchni OpenAI zapewnia spójność definicji narzędzi i schematów wyjścia strukturalnego.
Co jest godne uwagi w GPT-5.4 Mini
Architektura nagłówków i funkcje możliwości.
GPT-5.4 Mini wykorzystuje tę samą architekturę co reszta rodziny GPT-5: okno kontekstowe 400K tokenów, parametr reasoning_effort na czterech poziomach, buforowanie promptów, gdzie buforowane dane wejściowe są rozliczane po jednej dziesiątej stawki wejściowej, oraz powierzchnia Responses API. Obsługiwane są użycie narzędzi, ustrukturyzowane dane wyjściowe i multimodalne dane wejściowe wizyjne. Model jest mniejszym, szybszym rodzeństwem — mniej parametrów na token, większa przepustowość na dolara.
Specyfikacje w skrócie
Benchmarki GPT-5.4 Mini
Wyniki zgłoszone przez dostawcę z materiałów prasowych OpenAI GPT-5 Mini. Niezależne recenzje umieszczają 5.4 Mini w tej samej kategorii oszczędności kosztów co Kimi K2.7 Code w większości testów porównawczych agentów. Traktuj bezwzględne wartości procentowe jako orientacyjne.
Cennik GPT-5.4 Mini
Cena katalogowa dostawcy, za 1M tokenów.
Jak GPT-5.4 Mini zachowuje się w praktyce
Obserwowane zachowanie z uruchomień agentów produkcyjnych.
Prędkość
Najszybszy model w rodzinie GPT-5 — około 165 tokenów/sekundę przy średnim wysiłku według Artificial Analysis. To właśnie ta właściwość sprawia, że jest on wykonalny dla interaktywnych odpowiedzi na czacie i krótkich wywołań narzędzi typu fan-out, gdzie dominuje opóźnienie widoczne dla użytkownika.
Rutynowe wywołania narzędzi
Dokładny w standardowym katalogu narzędzi Codex. Tam, gdzie 5.4 wyprzedza, to trudne przypadki brzegowe (warunkowy wybór narzędzi, głęboko zagnieżdżone argumenty) — w rutynowych przypadkach Mini obsługuje routing narzędzi czysto za jedną trzecią kosztów.
Klasyfikacja masowa i wstępne filtrowanie
Najlepsza pozycja kosztowo-jakościowa w rodzinie GPT-5 dla prac rozproszonych. Masowe sortowanie PR, kategoryzacja zgłoszeń serwisowych, klasyfikacja dokumentów – wszystkie obciążenia, dla których wcześniej ręcznie tworzono wyrażenia regularne, są teraz przystępne cenowo w rzeczywistym wywołaniu modelu.
Efektywność kosztowa
0,3 kredytu z włączoną wizją multimodalną. Mini i Kimi K2.7 Code znajdują się w tym samym przedziale, podczas gdy DeepSeek V4 Pro jest niżej, na poziomie 0,1 — wybór zazwyczaj zależy od dopasowania do frameworka i zachowania w konkretnym obciążeniu.
Kiedy eskalować
Mini dryfuje na długich, wieloetapowych planach, trudnym rozumowaniu i pierwszych próbach edycji kodu wielu plików. Zbuduj agenta tak, aby orkiestrator decydował, kiedy eskalować do 5.4 lub 5.5, a nie tak, aby Mini próbował wykonać całą pętlę.
Najlepsze zadania agenta dla GPT-5.4 Mini
Klasyfikator rozgałęziający, który działa przy każdym zdarzeniu
Przychodzący zgłoszenie wsparcia, komentarz do PR, transkrypcja rozmowy sprzedażowej, przesłany dokument — Mini czyta każdy z nich i kieruje go do odpowiedniego agenta lub recenzenta. 0,3 kredytu i 165 tokenów/sekundę oznaczają, że koszt na zdarzenie jest na tyle niski, że uruchamianie go dla każdego zdarzenia (nie tylko dla próbek) jest faktycznie wykonalne.
Krok wstępnego filtrowania przed drogim modelem
Przypnij Mini na górze wywołania narzędzia agenta, aby zdecydował, czy żądanie w ogóle wymaga eskalacji. Większość żądań otrzymuje szybką i tanią odpowiedź; tylko resztkowa mniejszość płaci pełny koszt GPT-5.4 lub 5.5. To tutaj łączenie warstw oszczędnościowych i podstawowych naprawdę zmienia to, co jest przystępne cenowo.
Interaktywna odpowiedź na czacie
Krótkie, multimodalne tury, w których dominującym doświadczeniem jest widoczne dla użytkownika opóźnienie. Mini odpowiada wystarczająco szybko, aby strumieniowanie wydawało się natychmiastowe, a obsługa multimodalna oznacza, że zrzut ekranu w rozmowie po prostu działa.
Kiedy pominąć GPT-5.4 Mini
Pomiń GPT-5.4 Mini w przypadku najtrudniejszych zadań rozumowania, wieloetapowej orkiestracji agentów, sekwencji użycia komputera i pierwszych prób edycji kodu w wielu plikach — eskaluj do 5.4 dla rutynowych wersji tych zadań i do 5.5 dla najtrudniejszych.
GPT-5.4 Mini vs inne modele
GPT-5.4 Mini vs GPT-5.4
Ta sama rodzina, inne pozycjonowanie. 5.4 Mini (×0.3) wygrywa pod względem kosztów i szybkości; 5.4 (×1) wygrywa pod względem jakości rozumowania i dokładności routingu narzędzi w trudnych przypadkach. Standardowy wzorzec to wstępne filtrowanie za pomocą Mini i eskalowanie pozostałych przypadków do 5.4.
GPT-5.4 Mini vs Claude Sonnet 4.6
Claude Sonnet 4.6 jest aktualnym celem porównawczym katalogu dla tego modelu.
Podsumowując: czy powinieneś używać GPT-5.4 Mini?
GPT-5.4 Mini jest domyślnym modelem oszczędzającym koszty po stronie OpenAI. Wstępnie filtruj za pomocą Mini, eskaluj do GPT-5.4 dla rutynowych kroków, eskaluj do GPT-5.5 tylko dla najtrudniejszych rozumowań.
Często zadawane pytania
Jakie jest okno kontekstowe GPT-5.4 Mini?
400 000 tokenów, z maksymalnie 128 tys. tokenów wyjściowych na odpowiedź — tak samo jak reszta rodziny GPT-5.
Czy GPT-5.4 Mini obsługuje obrazy?
Tak. Podobnie jak reszta rodziny GPT-5, akceptuje obrazy jako dane wejściowe wraz z tekstem i kodem.
Kiedy powinienem wybrać GPT-5.4 Mini zamiast Kimi K2.7 Code?
Gdy Twój agent jest już zbudowany na frameworku Codex lub potrzebujesz ekosystemu OpenAI do strukturyzowanych danych wyjściowych/wywołań narzędzi. Oba kosztują 0,3 kredytu, więc koszt jest identyczny, a wybór zależy od frameworku i zachowania.
Czy GPT-5.4 Mini obsługuje buforowanie promptów?
Tak. Buforowane dane wejściowe są rozliczane po 0,075 USD za 1 milion tokenów — 10-krotna zniżka na buforowaną część.
Alternatywy
Dostępność GPT-5.4 Mini na Okou
GPT-5.4 Mini został usunięty z oferty Okou, więc nie można go już wybrać w czacie ani w przepływie pracy, i nie jest dostępny z własnym kluczem API. GPT 5.6 Luna obejmuje ten sam poziom oszczędności kosztów.

