Alle modeller

GPT-5.4: OpenAI ræsonnementsmodel

OpenAI's arbejdshest i GPT-5-familien. Ligger på ×1 kreditgrundlinjen sammen med Claude Sonnet 4.6 og er den rigtige standard for de fleste Codex-framework-agenter.

400K tokens · Text / Vision / Code · Prompt cache

Okou kører ikke længere GPT-5.4. Denne side opbevares som reference for dens specifikationer, priser og benchmarks. Til samme type arbejde, brug GPT 5.6 Luna.

Se GPT 5.6 Luna

GPT-5.4 er arbejdshesten i OpenAI's GPT-5-familie – den model, du som standard kører overalt. Leverandørrapporteret SWE-bench Verified på 74,9% placerer den i samme område som Claude Sonnet 4.6 inden for kodning, og dens værktøjsbrugsnøjagtighed er det, de fleste produktions-Codex-framework-agenter er tunet efter.

Hvad er GPT-5.4?

April 2026 · Arbejdshesten i GPT-5-familien. Den anbefalede standard for de fleste Codex-rammeagenter.

GPT-5.4 er arbejdshesten i OpenAI's GPT-5-generation, udgivet i april 2026 sammen med flagskibet GPT-5.5 og den omkostningsoptimerede GPT-5.4 Mini. OpenAI positionerer den som den overalt-standard for agenter på Codex-rammeværket – den model, du fortsat kører på hvert trin, medmindre et specifikt trin berettiger eskalering til 5.5.

Arkitektonisk deler GPT-5.4 400K-token kontekstvinduet, reasoning_effort-parameteren, prompt-caching og Responses API-overfladen med resten af GPT-5-familien. Forskellen i forhold til GPT-5.5 er beregningsinvesteringen pr. token: 5.4 kører hurtigere og billigere, 5.5 investerer mere i ræsonnementsdybde. Forskellen i forhold til GPT-5.4 Mini er det modsatte – 5.4 leverer mere kvalitet for de trin, der faktisk afgør agentkørslen.

Hvad er bemærkelsesværdigt ved GPT-5.4

Overskriftsarkitektur og kapacitetsfunktioner.

GPT-5.4 bruger den samme arkitektur som resten af GPT-5-familien: 400K-token kontekstvindue, reasoning_effort-parameter på fire niveauer (minimal, lav, medium, høj), prompt-caching hvor cachelagret input faktureres til en tiendedel af inputraten, og Responses API-overfladen, som codex CLI bruger som standard. Værktøjsbrug, strukturerede outputs og computerbrug understøttes. Inputs er multimodale på tværs af tekst, vision og kode.

Specifikationer på et øjeblik

FamilieGPT-5-generering
ModaliteterTekst, vision, kode
SprogEngelsk-først, flersproget
Prompt-cachelagringUnderstøttet (OpenAI)
Kontekstvindue400K tokens
Max outputOp til 128K tokens
BegrundelsesindsatsMinimal / Lav / Medium / Høj
Leverandørens listepris2,5 $ input / 15 $ output pr. 1M

GPT-5.4 benchmarks

Leverandørrapporterede scores fra OpenAI's GPT-5-udgivelsesmaterialer, med deltas vist i forhold til den tidligere OpenAI-generation. Uafhængige anmeldelser placerer GPT-5.4 i samme kodningskvalitetsbånd som Claude Sonnet 4.6. Behandl absolutte procenter som retningsgivende.

SWE-bench Verificeretleverandør-rapporteret
74.9%
Terminal-Bench 2.0leverandørrapporteret brug af værktøjer
~58%
AIME 2025 (ingen værktøjer)leverandørrapporteret konkurrencematematik
~92%
GPQA Diamondleverandørrapporteret kandidatvidenskab
~85%
OSWorld (computerbrug)leverandør-rapporteret
~62%
HastighedKunstig analyse, medium indsats
~110 tokens/sek

GPT-5.4 priser

Udbyderens listepris, pr. 1M tokens.

Input$2.50
Output$15.00
Cachelæsning$0.25
Cache-skrivningIkke faktureret

Hvordan GPT-5.4 opfører sig i praksis

Observeret adfærd fra produktionsagentkørsler.

Værktøjsrouting

Solid grundlæggende nøjagtighed på tværs af standard Codex-rammeværktøjskataloget. Hvor 5.5 trækker fra, er på vanskelige grænsetilfælde (betinget værktøjsvalg, dybt indlejrede argumenter) – for rutinetilfældene dirigerer 5.4 korrekt med betydeligt lavere latenstid.

Kodeændringer

Sammenlignelig patchkvalitet med Claude Sonnet 4.6 på standard refaktor- og fejlrettelsesopgaver. Hvor 5.5 begynder at trække fra, er på ændringer i flere filer, hvor patchen skal anvendes rent ved første forsøg.

Hastighed

Mærkbart hurtigere end 5.5 – omkring 110 tokens/sek. ved medium indsats pr. Artificial Analysis. Dette er en del af grunden til, at 5.4 forbliver standard for interaktive chat-svar og korte agent-loops, hvor bruger-synlig latenstid er vigtig.

Omkostningseffektivitet

×1 kreditter med outputadfærd i Sonnet 4.6 kvalitetsbåndet. For teams, der allerede bruger Codex-rammeværket, er dette det optimale punkt for omkostning/kvalitet – opgrader kun til 5.5 på trin, der synligt har brug for det.

Hallucinationsadfærd

Arver de kalibreringsforbedringer, OpenAI leverede med GPT-5-generationen. Mindre tilbøjelig til selvsikre forkerte svar end GPT-4-serien, især på spørgsmål uden for dens træningshorisont.

Bedste agentopgaver for GPT-5.4

Standardagenttrinnet på Codex-rammeværket

Hvis din agent allerede er bygget på codex CLI eller en hvilken som helst Codex-rammeintegration, er GPT-5.4 den naturlige standard overalt. ×1 kreditter, hurtig nok til interaktiv brug, nøjagtig nok til de rutinemæssige værktøjskald, der dominerer de fleste agentkørsler.

Hvornår man skal springe GPT-5.4 over

Spring GPT-5.4 over ved den sværeste ræsonnement, computerbrug eller multi-fil kode-redigeringstrin, hvor 5.5 mærkbart fører, og ved højvolumen bulkklassificering eller forfiltreringsarbejde, hvor 5.4 Mini er fire gange billigere på leverandørniveau.

GPT-5.4 vs. andre modeller

GPT-5.4 vs GPT-5.5

Samme familie, forskellig positionering. 5.5 (×2) giver dig den stærkeste ræsonnement, computerbrug og kodekvalitet ved første forsøg; 5.4 (×1) giver dig det samme kontekstvindue og funktionssæt til halvdelen af kreditomkostningerne og mærkbart højere hastighed. Standard er 5.4; eskaler kun til 5.5 på de trin, der synligt har brug for det.

GPT-5.4 vs Claude Sonnet 4.6

De to ×1 baselinjer, en i hvert økosystem. Sonnet 4.6 kører på Claude Code-rammeværket; GPT-5.4 kører på Codex. Vælg efter hvilket rammeværk dine eksisterende agenter og værktøjsdefinitioner er rettet mod. På rå outputkvalitet er de tæt nok på, at A/B-test på din arbejdsbyrde er det rigtige valg.

GPT-5.4 vs GPT-5.4 Mini

Samme familie, forskellig positionering. 5.4 (×1) har mere ræsonnementskvalitet pr. token; 5.4 Mini (×0.3) giver dig en meget billigere mulighed for bulk- og forfiltreringsarbejde. Brug 5.4 Mini til fan-out-klassificering og 5.4 til de trin, der bestemmer agentkørslen.

Ofte stillede spørgsmål

Hvad er GPT-5.4's kontekstvindue?

400.000 tokens, med op til 128K tokens output pr. svar. Det fulde vindue faktureres til standardpriser.

Kan GPT-5.4 håndtere billeder?

Ja. GPT-5.4 er multimodal. Den accepterer billedinput sammen med tekst og kode nativt.

Hvornår skal jeg vælge GPT-5.4 frem for Claude Sonnet 4.6?

Når din agent allerede er bygget på Codex-rammeværket, eller du har brug for OpenAI-økosystemet (værktøjskatalog, strukturerede outputs, Responses API). Begge koster ×1 credits, så omkostningerne er identiske, og valget afhænger af rammeværket og adfærdsfit.

Understøtter GPT-5.4 prompt-caching?

Ja. Cachelagret input faktureres til $0,25 pr. 1M tokens – en 10x rabat på den cachelagrede del.

Alternativer

Tilgængelighed af GPT-5.4 på Okou

GPT-5.4 er blevet fjernet fra Okou-udvalget, så den kan ikke længere vælges i chat eller i en arbejdsgang, og den er ikke tilgængelig med din egen API-nøgle. GPT 5.6 Luna dækker det samme omkostningsbesparende niveau.