GPT-5.4 Mini: OpenAI:s kompakta resonemangsmodell
OpenAI:s kostnadsoptimerade medlem av GPT-5-familjen. ×0,3 krediter, multimodal vision och tillräckligt snabb för routing, klassificering och förfiltrering av stora volymer.
400K tokens · Text / Vision / Code · Prompt cache
Okou kör inte längre GPT-5.4 Mini. Denna sida behålls som referens för dess specifikationer, prissättning och benchmarks. För samma typ av arbete, använd GPT 5.6 Luna.
Se GPT 5.6 LunaGPT-5.4 Mini är den kostnadsbesparande medlemmen i OpenAI:s GPT-5-familj – den du väljer när enhetskostnaden är viktigare än den högsta resonemangskvaliteten. Den behåller 400K kontextfönstret och multimodala ingångar från resten av familjen men minskar beräkningen per token, vilket leder till lägre pris ($0.75 / $4.5 per 1M) och märkbart högre hastighet.
Vad är GPT-5.4 Mini?
April 2026 · Kostnadsbesparande variant av GPT-5-familjen. OpenAI-sidans motsvarighet till Kimi K2.7 Code.
GPT-5.4 Mini är den kostnadsoptimerade medlemmen av OpenAI:s GPT-5-generation, släppt i april 2026 tillsammans med GPT-5.5 och GPT-5.4. OpenAI positionerar den som den höga genomströmningsnivån – modellen du fortsätter att köra på klassificering, dirigering och förfiltreringssteg där de större 5.4 eller 5.5 skulle slösas bort på rutinbeslut.
Arkitektoniskt delar den GPT-5-familjens 400K-token kontextfönster, reasoning_effort-parametern, promptcaching och Responses API-ytan som codex CLI använder som standard. Kompromissen jämfört med 5.4 är resonemangsdjup: Mini hanterar standardverktygsanrop, korta sammanfattningar och strukturerade utdataarbetsbelastningar väl, men börjar avvika på de svårare flerstegsplanerna där 5.4 fortfarande håller. Kompromissen jämfört med konkurrenter till samma pris är ekosystem – om du redan använder Codex, håller du dig inom OpenAI-ytan för att hålla verktygsdefinitioner och strukturerade utdatascheman konsekventa.
Vad är anmärkningsvärt med GPT-5.4 Mini
Rubrikarkitektur och funktionsfunktioner.
GPT-5.4 Mini använder samma arkitektur som resten av GPT-5-familjen: 400K-token kontextfönster, reasoning_effort-parametern på fyra nivåer, promptcaching där cachad input faktureras till en tiondel av inputhastigheten, och Responses API-ytan. Verktygsanvändning, strukturerade utdata och multimodala vision-inputs stöds. Modellen är ett mindre, snabbare syskon – färre parametrar per token, mer genomströmning per dollar.
Specifikationer i korthet
GPT-5.4 Mini benchmarks
Leverantörsrapporterade poäng från OpenAI:s GPT-5 Mini-lanseringsmaterial. Oberoende recensioner placerar 5.4 Mini i samma kostnadsbesparande band som Kimi K2.7 Code på de flesta agentbenchmarks. Behandla absoluta procentsatser som vägledande.
GPT-5.4 Mini prissättning
Leverantörens listpris, per 1M tokens.
Hur GPT-5.4 Mini beter sig i praktiken
Observerat beteende från produktionsagentkörningar.
Hastighet
Snabbaste modellen i GPT-5-familjen – cirka 165 tokens/sekund vid medelhög ansträngning enligt Artificial Analysis. Detta är egenskapen som gör den användbar för interaktiva chattrepliker och korta fan-out-verktygsanrop där användarsynlig latens dominerar.
Rutinmässiga verktygsanrop
Noggrann på standard Codex-ramverkets verktygskatalog. Där 5.4 ligger före är på svåra gränsfall (villkorligt verktygsval, djupt kapslade argument) – för rutinfall hanterar Mini verktygsroutning rent till en tredjedel av kostnaden.
Massklassificering & förfiltrering
Starkaste kostnads-/kvalitetspositionen i GPT-5-familjen för fan-out-arbete. Mass-PR-triage, kategorisering av supportärenden, dokumentnivåklassificering – alla arbetsbelastningar där du tidigare skulle ha handrullat regex är nu prisvärda i ett riktigt modellanrop.
Kostnadseffektivitet
×0,3 krediter inklusive multimodal vision. Mini och Kimi K2.7 Code ligger i samma band, medan DeepSeek V4 Pro ligger lägre på ×0,1 – valet beror oftast på ramverksanpassning och beteende för din specifika arbetsbelastning.
När man ska eskalera
Mini driver på långa flerstegsplaner, svårt resonemang och första försök till kodredigeringar med flera filer. Bygg agenten så att orkestratorn bestämmer när den ska eskalera till 5.4 eller 5.5, inte så att Mini försöker bära hela loopen.
Bästa agentuppgifter för GPT-5.4 Mini
Den utspridda klassificeraren som körs vid varje händelse
Inkommande supportärende, PR-kommentar, säljsamtalsutskrift, dokumentuppladdning – Mini läser varje och dirigerar det till rätt nedströmsagent eller mänsklig granskare. ×0.3 krediter och 165 tokens/sekund innebär att kostnaden per händelse är tillräckligt liten för att det faktiskt är genomförbart att köra den på varje händelse (inte bara samplade batchar).
Förfiltreringssteget före den dyra modellen
Fäst Mini högst upp i agentens verktygsanrop så att den avgör om begäran ens behöver eskaleras. De flesta förfrågningar får ett snabbt billigt svar; endast den återstående minoriteten betalar hela GPT-5.4- eller 5.5-kostnaden. Det är här som att stapla kostnadsbesparande och kärnnivåer verkligen förändrar vad som är överkomligt.
Det interaktiva chatt svaret
Korta multimodala vändningar där användarsynlig latens dominerar upplevelsen. Mini svarar tillräckligt snabbt för att streaming ska kännas omedelbar, och det multimodala stödet innebär att en skärmdump i konversationen bara fungerar.
När man ska hoppa över GPT-5.4 Mini
Hoppa över GPT-5.4 Mini för den svåraste resonemanget, flerstegsagentorkestrering, datoranvändningssekvenser och första försöket med kodredigeringar i flera filer – eskalera till 5.4 för rutinversioner av dessa uppgifter och 5.5 för de svåraste.
GPT-5.4 Mini vs andra modeller
GPT-5.4 Mini vs GPT-5.4
Samma familj, olika positionering. 5.4 Mini (×0.3) vinner på kostnad och hastighet; 5.4 (×1) vinner på resonemangskvalitet och verktygsrouteringsnoggrannhet i svåra fall. Standardmönstret är att förfiltrera med Mini och eskalera återstående fall till 5.4.
GPT-5.4 Mini vs Claude Sonnet 4.6
Claude Sonnet 4.6 är det nuvarande katalogjämförelsemålet för denna modell.
Slutsats: ska du använda GPT-5.4 Mini?
GPT-5.4 Mini är det kostnadsbesparande standardalternativet på OpenAI-sidan. Förfiltrera med Mini, eskalera till GPT-5.4 för rutinmässiga steg, eskalera till GPT-5.5 endast för de svåraste resonemangen.
Vanliga frågor
Vad är GPT-5.4 Minis kontextfönster?
400 000 tokens, med upp till 128K tokens utdata per svar – samma som resten av GPT-5-familjen.
Kan GPT-5.4 Mini hantera bilder?
Ja. Liksom resten av GPT-5-familjen accepterar den bildinmatningar tillsammans med text och kod.
När ska jag välja GPT-5.4 Mini istället för Kimi K2.7 Code?
När din agent redan är byggd på Codex-ramverket eller du behöver OpenAI:s ekosystem för strukturerad utdata/verktygsanrop. Båda kostar ×0,3 krediter, så kostnaden är identisk och valet handlar om ramverk och beteende.
Stöder GPT-5.4 Mini prompt-caching?
Ja. Cachad inmatning faktureras med 0,075 USD per 1 miljon tokens – en 10x rabatt på den cachade delen.
Alternativ
Tillgänglighet av GPT-5.4 Mini på Okou
GPT-5.4 Mini har tagits bort från Okou-sortimentet, så det kan inte längre väljas i chatt eller i ett arbetsflöde, och det är inte tillgängligt med din egen API-nyckel. GPT 5.6 Luna täcker samma kostnadsbesparande nivå.

