Alla modeller

GPT-5.4: OpenAI resonemangsmodell

OpenAI:s arbetshäst i GPT-5-familjen. Ligger på ×1 kreditbaslinjen tillsammans med Claude Sonnet 4.6 och är standardvalet för de flesta Codex-ramverksagenter.

400K tokens · Text / Vision / Code · Prompt cache

Okou kör inte längre GPT-5.4. Denna sida behålls som referens för dess specifikationer, prissättning och benchmarks. För samma typ av arbete, använd GPT 5.6 Luna.

Se GPT 5.6 Luna

GPT-5.4 är arbetshästen i OpenAI:s GPT-5-familj – modellen du fortsätter att köra överallt som standard. Leverantörsrapporterad SWE-bench Verified på 74,9 % placerar den i samma intervall som Claude Sonnet 4.6 när det gäller kodning, och dess verktygsanvändningsnoggrannhet är vad de flesta produktions-Codex-ramverksagenter är inställda mot.

Vad är GPT-5.4?

April 2026 · Arbetshäst i GPT-5-familjen. Den rekommenderade standarden för de flesta Codex-ramverksagenter.

GPT-5.4 är arbetshästen i OpenAI:s GPT-5-generation, släppt i april 2026 tillsammans med flaggskeppet GPT-5.5 och den kostnadsoptimerade GPT-5.4 Mini. OpenAI positionerar den som standardmodellen för agenter på Codex-ramverket – modellen du fortsätter att köra i varje steg om inte ett specifikt steg motiverar en eskalering till 5.5.

Arkitektoniskt delar GPT-5.4 400K-token kontextfönstret, reasoning_effort-parametern, promptcaching och Responses API-ytan med resten av GPT-5-familjen. Skillnaden mot GPT-5.5 är beräkningsinvesteringen per token: 5.4 körs snabbare och billigare, 5.5 investerar mer i resonemangsdjup. Skillnaden mot GPT-5.4 Mini är den motsatta – 5.4 har högre kvalitet för de steg som faktiskt avgör agentkörningen.

Vad är anmärkningsvärt med GPT-5.4

Rubrikarkitektur och funktionsfunktioner.

GPT-5.4 använder samma arkitektur som resten av GPT-5-familjen: 400K-token kontextfönster, reasoning_effort-parameter på fyra nivåer (minimal, låg, medium, hög), promptcaching där cachad input faktureras till en tiondel av inputhastigheten, och Responses API-ytan som codex CLI använder som standard. Verktygsanvändning, strukturerade utdata och datoranvändning stöds. Input är multimodal över text, vision och kod.

Specifikationer i korthet

FamiljGPT-5-generering
ModaliteterText, vision, kod
SpråkEngelska först, flerspråkig
Prompt-cachelagringStöds (OpenAI)
Kontextfönster400K tokens
Max utdataUpp till 128K tokens
ResonemangsinsatsMinimal / Låg / Medel / Hög
Leverantörens listpris2,5 $ input / 15 $ output per 1M

GPT-5.4 benchmarks

Leverantörsrapporterade poäng från OpenAI:s GPT-5-lanseringsmaterial, med skillnader visade mot den tidigare OpenAI-generationen. Oberoende recensioner placerar GPT-5.4 i samma kodningskvalitetsband som Claude Sonnet 4.6. Behandla absoluta procentsatser som riktningsgivande.

SWE-bench Verifieradleverantörsrapporterad
74.9%
Terminal-Bench 2.0leverantörsrapporterad verktygsanvändning
~58%
AIME 2025 (inga verktyg)leverantörsrapporterad konkurrensmatematik
~92%
GPQA Diamondleverantörsrapporterad forskarvetenskap
~85%
OSWorld (datoranvändning)leverantörsrapporterad
~62%
HastighetArtificiell analys, medelhög ansträngning
~110 tokens/sek

GPT-5.4 prissättning

Leverantörens listpris, per 1M tokens.

Inmatning$2.50
Utdata$15.00
Cacheläsning$0.25
CacheskrivningEj fakturerad

Hur GPT-5.4 beter sig i praktiken

Observerat beteende från produktionsagentkörningar.

Verktygsdirigering

Solid baslinje noggrannhet över standard Codex-ramverkets verktygskatalog. Där 5.5 drar ifrån är på svåra gränsfall (villkorligt verktygsval, djupt kapslade argument) – för rutinfall dirigerar 5.4 korrekt med betydligt lägre latens.

Kodredigeringar

Jämförbar patchkvalitet med Claude Sonnet 4.6 på standardrefaktorering och buggfix-arbetsbelastningar. Där 5.5 börjar dra ifrån är vid ändringar i flera filer där patchen måste appliceras rent vid första försöket.

Hastighet

Betydligt snabbare än 5.5 – cirka 110 tokens/sek vid medelhög ansträngning per Artificial Analysis. Detta är en del av varför 5.4 förblir standard för interaktiva chattrepliker och korta agentloopar där användarsynlig latens spelar roll.

Kostnadseffektivitet

×1 krediter med utdatabeteende i Sonnet 4.6 kvalitetsband. För team som redan använder Codex-ramverket är detta den optimala kostnads-/kvalitetspunkten – uppgradera till 5.5 endast på steg som synbart behöver det.

Hallucinationsbeteende

Ärver kalibreringsförbättringarna OpenAI levererade med GPT-5-generationen. Mindre benägen att ge självsäkra felaktiga svar än GPT-4-serien, särskilt på frågor utanför dess träningshorisont.

Bästa agentuppgifter för GPT-5.4

Standardagentsteget på Codex-ramverket

Om din agent redan är byggd på codex CLI eller någon Codex-ramverksintegration, är GPT-5.4 det naturliga standardvalet överallt. ×1 krediter, tillräckligt snabb för interaktiv användning, tillräckligt noggrann för de rutinmässiga verktygsanrop som dominerar de flesta agentkörningar.

När man ska hoppa över GPT-5.4

Hoppa över GPT-5.4 för den svåraste resonemanget, datoranvändning eller kodredigering i flera filer där 5.5 märkbart leder, och för högvolymsklassificering eller förfiltreringsarbete där 5.4 Mini är fyra gånger billigare på leverantörsnivå.

GPT-5.4 vs andra modeller

GPT-5.4 vs GPT-5.5

Samma familj, annorlunda positionering. 5.5 (×2) ger dig den starkaste resonemangsförmågan, datoranvändningen och kodkvaliteten vid första försöket; 5.4 (×1) ger dig samma kontextfönster och funktionsuppsättning till halva kreditkostnaden och märkbart högre hastighet. Standard är 5.4; eskalera till 5.5 endast på de steg som synbart behöver det.

GPT-5.4 vs Claude Sonnet 4.6

De två ×1 baslinjerna, en i varje ekosystem. Sonnet 4.6 körs på Claude Code-ramverket; GPT-5.4 körs på Codex. Välj efter vilket ramverk dina befintliga agenter och verktygsdefinitioner riktar sig mot. När det gäller rå utdatakvalitet är de tillräckligt nära att A/B-testning på din arbetsbelastning är det rätta valet.

GPT-5.4 vs GPT-5.4 Mini

Samma familj, olika positionering. 5.4 (×1) har högre resonemangskvalitet per token; 5.4 Mini (×0.3) ger dig ett mycket billigare alternativ för bulk- och förfiltreringsarbete. Använd 5.4 Mini för fan-out-klassificering och 5.4 för stegen som bestämmer agentkörningen.

Vanliga frågor

Vad är GPT-5.4:s kontextfönster?

400 000 tokens, med upp till 128K tokens utdata per svar. Hela fönstret faktureras till standardpriser.

Kan GPT-5.4 hantera bilder?

Ja. GPT-5.4 är multimodal. Den accepterar bildinmatningar tillsammans med text och kod inbyggt.

När ska jag välja GPT-5.4 över Claude Sonnet 4.6?

När din agent redan är byggd på Codex-ramverket eller du behöver OpenAI-ekosystemet (verktygskatalog, strukturerade utdata, Responses API). Båda ligger på ×1 krediter, så kostnaden är identisk och valet handlar om ramverk och beteendepassning.

Stöder GPT-5.4 promptcaching?

Ja. Cachad inmatning faktureras med 0,25 USD per 1 miljon tokens – en 10x rabatt på den cachade delen.

Alternativ

Tillgänglighet av GPT-5.4 på Okou

GPT-5.4 har tagits bort från Okou-sortimentet, så det kan inte längre väljas i chatt eller i ett arbetsflöde, och det är inte tillgängligt med din egen API-nyckel. GPT 5.6 Luna täcker samma kostnadsbesparande nivå.