Alle modellen

GPT-5.4 Mini: OpenAI's compacte redeneermodel

OpenAI's kosten-geoptimaliseerde lid van de GPT-5 familie. ×0.3 credits, multimodale visie, en snel genoeg voor high-volume routing, classificatie en pre-filter werk.

400K tokens · Text / Vision / Code · Prompt cache

Okou draait GPT-5.4 Mini niet langer. Deze pagina wordt bewaard als referentie voor de specificaties, prijzen en benchmarks. Gebruik GPT 5.6 Luna voor hetzelfde soort werk.

Zie GPT 5.6 Luna

GPT-5.4 Mini is het kostenbesparende lid van OpenAI's GPT-5-familie — degene die je kiest wanneer de eenheidskosten belangrijker zijn dan de maximale redeneerkwaliteit. Het behoudt het 400K contextvenster en de multimodale invoer van de rest van de familie, maar vermindert de rekenkracht per token, wat zich vertaalt in een lagere prijs ($0,75 / $4,5 per 1M) en een merkbaar hogere snelheid.

Wat is GPT-5.4 Mini?

April 2026 · Kostenbesparende variant van de GPT-5-familie. De OpenAI-side peer van Kimi K2.7 Code.

GPT-5.4 Mini is het kosten-geoptimaliseerde lid van OpenAI's GPT-5 generatie, uitgebracht in april 2026 naast GPT-5.5 en GPT-5.4. OpenAI positioneert het als de high-throughput tier — het model dat u blijft draaien op classificatie-, routerings- en voorfilterstappen waar de grotere 5.4 of 5.5 verspild zouden zijn aan routinematige beslissingen.

Architectonisch deelt het de 400K-token contextvenster van de GPT-5 familie, de reasoning_effort parameter, prompt caching, en de Responses API interface die codex CLI standaard gebruikt. De afweging ten opzichte van 5.4 is de diepte van het redeneren: Mini verwerkt standaard tool calls, korte samenvattingen en gestructureerde output workloads goed, maar begint af te dwalen bij de moeilijkere meerstapsplannen waar 5.4 nog steeds standhoudt. De afweging ten opzichte van concurrenten met dezelfde prijs is het ecosysteem — als je al op Codex zit, zorgt het binnen de OpenAI interface blijven ervoor dat tooldefinities en gestructureerde output schema's consistent blijven.

Wat is opmerkelijk aan GPT-5.4 Mini

Koparchitectuur en functionaliteiten.

GPT-5.4 Mini gebruikt dezelfde architectuur als de rest van de GPT-5 familie: 400K-token contextvenster, de reasoning_effort parameter op vier niveaus, prompt caching waarbij gecachte invoer wordt gefactureerd tegen een tiende van het invoertarief, en de Responses API interface. Tool-gebruik, gestructureerde uitvoer en multimodale visuele invoer worden ondersteund. Het model is een kleinere, snellere broer of zus — minder parameters per token, meer doorvoer per dollar.

Specificaties in één oogopslag

FamilieGPT-5 generatie
ModaliteitenTekst, visie, code
TalenEngels-eerst, meertalig
Prompt cachingOndersteund (OpenAI)
Contextvenster400K tokens
Max uitvoerTot 128K tokens
RedeneerinspanningMinimaal / Laag / Gemiddeld / Hoog
Leverancierslijstprijs$0,75 invoer / $4,5 uitvoer per 1M

GPT-5.4 Mini benchmarks

Door de leverancier gerapporteerde scores uit de OpenAI's GPT-5 Mini-releasematerialen. Onafhankelijke beoordelingen plaatsen 5.4 Mini in dezelfde kostenbesparende band als Kimi K2.7 Code op de meeste agentbenchmarks. Behandel absolute percentages als richtinggevend.

SWE-bench Geverifieerddoor leverancier gerapporteerd
~60%
Terminal-Bench 2.0door leverancier gerapporteerd toolgebruik
~42%
AIME 2025 (geen tools)door leverancier gerapporteerde concurrentiemath
~84%
GPQA Diamonddoor leverancier gerapporteerde afgestudeerde wetenschap
~74%
SnelheidKunstmatige analyse, gemiddelde inspanning
~165 tokens/sec

GPT-5.4 Mini prijzen

Catalogusprijs van de provider, per 1M tokens.

Invoer$0.75
Uitvoer$4.50
Cache lezen$0.07
Cache schrijvenNiet gefactureerd

Hoe GPT-5.4 Mini zich in de praktijk gedraagt

Waargenomen gedrag van productieve agentruns.

Snelheid

Snelste model in de GPT-5 familie — ongeveer 165 tokens/sec bij gemiddelde inspanning volgens Artificial Analysis. Dit is de eigenschap die het levensvatbaar maakt voor interactieve chatantwoorden en korte fan-out tool calls waarbij gebruikerszichtbare latentie domineert.

Routine tool calls

Nauwkeurig op de standaard Codex-framework toolcatalogus. Waar 5.4 voorloopt, is op moeilijke randgevallen (conditionele toolselectie, diep geneste argumenten) — voor de routinegevallen verwerkt Mini tool-routing netjes tegen een derde van de kosten.

Bulkclassificatie & voorfilter

Sterkste kosten/kwaliteitspositie in de GPT-5-familie voor fan-out werk. Bulk PR triage, categorisatie van supporttickets, document-tier classificatie — alle workloads waar je voorheen handmatig regex zou hebben gebruikt, zijn nu betaalbaar in een echte modelaanroep.

Kostenefficiëntie

×0,3 credits inclusief multimodale visie. Mini en Kimi K2.7 Code vallen in dezelfde band, terwijl DeepSeek V4 Pro lager zit op ×0,1 — de keuze hangt meestal af van de framework-fit en het gedrag op uw specifieke workload.

Wanneer escaleren

Mini dwaalt af bij lange meerstapsplannen, moeilijk redeneren en eerste pogingen tot codebewerkingen met meerdere bestanden. Bouw de agent zo dat de orkestrator beslist wanneer hij moet escaleren naar 5.4 of 5.5, niet zodat Mini de hele lus probeert te dragen.

Beste agenttaken voor GPT-5.4 Mini

De fan-out classifier die draait op elke gebeurtenis

Inkomend supportticket, PR-commentaar, transcript van verkoopgesprek, documentupload — Mini leest elk ervan en routeert het naar de juiste downstream agent of menselijke beoordelaar. ×0.3 credits en 165 tokens/sec betekenen dat de kosten per gebeurtenis klein genoeg zijn dat het uitvoeren ervan bij elke gebeurtenis (niet alleen bij steekproeven) daadwerkelijk haalbaar is.

De voorfilterstap vóór het dure model

Pin Mini bovenaan de tool-aanroep van de agent, zodat deze beslist of het verzoek überhaupt moet escaleren. De meeste verzoeken krijgen een snel, goedkoop antwoord; alleen de resterende minderheid betaalt de volledige GPT-5.4 of 5.5 kosten. Dit is waar het stapelen van kostenbesparende en kernlagen echt verandert wat betaalbaar is.

Het interactieve chatantwoord

Korte multimodale beurten waarbij de door de gebruiker zichtbare latentie de ervaring domineert. Mini antwoordt snel genoeg dat streamen direct aanvoelt, en de multimodale ondersteuning betekent dat een screenshot in het gesprek gewoon werkt.

Wanneer GPT-5.4 Mini overslaan

Sla GPT-5.4 Mini over voor de moeilijkste redeneringen, multi-step agent-orkestratie, computergebruiksequenties en eerste pogingen tot multi-bestandscodebewerkingen — escaleer naar 5.4 voor routineversies van die taken en 5.5 voor de moeilijkste.

GPT-5.4 Mini versus andere modellen

GPT-5.4 Mini vs GPT-5.4

Zelfde familie, andere positionering. 5.4 Mini (×0.3) wint op kosten en snelheid; 5.4 (×1) wint op redeneerkwaliteit en nauwkeurigheid van tool-routing in moeilijke gevallen. Het standaardpatroon is om voor te filteren met Mini en resterende gevallen te escaleren naar 5.4.

GPT-5.4 Mini vs Claude Sonnet 4.6

Claude Sonnet 4.6 is het huidige catalogusvergelijkingsobject voor dit model.

Conclusie: moet je GPT-5.4 Mini gebruiken?

GPT-5.4 Mini is de kostenbesparende standaard aan de OpenAI-kant. Voorfilter met Mini, escaleer naar GPT-5.4 voor routinestappen, escaleer naar GPT-5.5 alleen voor de moeilijkste redeneringen.

Veelgestelde vragen

Wat is de contextvenster van GPT-5.4 Mini?

400.000 tokens, met tot 128K tokens output per antwoord — hetzelfde als de rest van de GPT-5 familie.

Kan GPT-5.4 Mini afbeeldingen verwerken?

Ja. Net als de rest van de GPT-5-familie accepteert het afbeeldingsinvoer naast tekst en code.

Wanneer moet ik GPT-5.4 Mini kiezen boven Kimi K2.7 Code?

Wanneer uw agent al is gebouwd op het Codex-framework of u het OpenAI-ecosysteem voor gestructureerde uitvoer/tool-aanroepen nodig heeft. Beide kosten ×0,3 credits, dus de kosten zijn identiek en de keuze hangt af van het framework en het gedrag.

Ondersteunt GPT-5.4 Mini prompt caching?

Ja. Gecachte invoer wordt gefactureerd tegen $0,075 per 1M tokens — een korting van 10× op het gecachte gedeelte.

Alternatieven

Beschikbaarheid van GPT-5.4 Mini op Okou.

GPT-5.4 Mini is verwijderd uit de Okou-line-up, dus het kan niet langer worden geselecteerd in chat of in een workflow, en het is niet beschikbaar met uw eigen API-sleutel. GPT 5.6 Luna dekt dezelfde kostenbesparende tier.