Alla modeller

GPT-5.5 på Okou. OpenAI:s flaggskeppsmodell för resonemang

OpenAI:s flaggskepp i GPT-5-familjen. Det starkaste valet för agentisk kodning, djup resonemang och datoranvändningsloopar på OpenAI-nivån.

400K tokens · Text / Vision / Code · Prompt cache

GPT-5.5 är modellen du väljer när arbetet kräver både djupt resonemang och pålitlig verktygsanvändning: orkestrering av flerstegsagentloopar, kodredigeringar som måste lyckas på första försöket, och datoranvändningsarbetsflöden som spänner över många GUI-åtgärder. Leverantörsbenchmarks (SWE-bench Verified, AIME 2025, GPQA Diamond) ger konkreta siffror på vinsterna jämfört med GPT-5.4.

Vad är GPT-5.5?

April 2026 (efterträdare till GPT-5.4) · Toppskiktet av GPT-5-familjen. OpenAI:s flaggskepp för agentisk kodning och resonemang.

GPT-5.5 är flaggskeppet i OpenAI:s GPT-5-generation, släppt i april 2026 som den rekommenderade uppgraderingen från GPT-5.4. OpenAI beskriver den som en betydande förbättring av agentisk verktygsanvändning och datoranvändningsuppgifter snarare än en uppdatering av ytan API. Kontextfönstret på 400K-token och parametern reasoning_effort som introducerades med GPT-5 överförs oförändrade, så befintliga Codex-agenter kan användas utan omskrivningar.

Oberoende topplistor (Artificial Analysis, Vellum) bekräftar den relativa ordningen mot GPT-5.4 och placerar GPT-5.5 inom några poäng från Claude Opus 4.7 på de flesta agentiska kodningsuppgifter. Absoluta siffror skiftar varje vecka och OpenAI har själv flaggat träningsdatakontaminering på SWE-bench Verified över frontlinjemodeller. Behandla de offentliga poängen som riktningsgivande snarare än auktoritativa; de strukturerade beteendeskillnaderna (verktygsanropsnoggrannhet, datoranvändningspålitlighet, första försöks patchkvalitet) är den mer hållbara signalen.

Vad är anmärkningsvärt med GPT-5.5

Rubrikarkitektur och funktionsfunktioner.

GPT-5.5 behåller 400K-token kontextfönstret från GPT-5.4, fakturerat till standardinmatningspriser över hela fönstret. Den stöder reasoning_effort-parametern på fyra nivåer (minimal, låg, medium, hög), promptcaching där cachad inmatning faktureras till en tiondel av inmatningspriset, och Responses API-ytan som codex CLI använder som standard. Verktygsanvändning, strukturerade utdata och datoranvändning är oförändrade från 5.4. Indata är multimodala över text, vision och kod; modellen har ingen inbyggd bildgenerering (använd Images API för det).

Specifikationer i korthet

FamiljGPT-5-generering
ModaliteterText, vision, kod
SpråkEngelska först, flerspråkig
Prompt-cachelagringStöds (OpenAI)
Kontextfönster400K tokens
Max utdataUpp till 128K tokens
ResonemangsinsatsMinimal / Låg / Medel / Hög
Leverantörens listpris5 $ input / 30 $ output per 1M

GPT-5.5 benchmarks

Leverantörsrapporterade poäng från OpenAI:s GPT-5.5-releasematerial, med skillnader visade mot de offentliga GPT-5.4-siffrorna. Oberoende recensioner placerar 5.5 inom några poäng från Claude Opus 4.7 på agentiska kodningsuppgifter. Behandla absoluta procentsatser som riktgivande; OpenAI har flaggat för kontaminering av träningsdata på SWE-bench Verified över alla frontlinjemodeller.

SWE-bench Verifieradleverantörsrapporterat; upp från 5.4:s 74.9%
~82%
Terminal-Bench 2.0leverantörsrapporterad verktygsanvändning
~69%
AIME 2025 (inga verktyg)leverantörsrapporterad konkurrensmatematik
~96%
GPQA Diamondleverantörsrapporterad forskarvetenskap
~89%
OSWorld (datoranvändning)leverantörsrapporterad
~74%
MMMU (multimodal)leverantörsrapporterad
Leder GPT-5-familjen
HastighetArtificiell analys, medelhög ansträngning
~70 tokens/sek

GPT-5.5 prissättning

Leverantörens listpris, per 1M tokens.

Inmatning$5.00
Utdata$30.00
Cacheläsning$0.50
CacheskrivningEj fakturerad

Hur GPT-5.5 beter sig i praktiken

Observerat beteende från produktionsagentkörningar.

Verktygsdirigering

Lägsta frekvensen av felaktigt dirigerade verktygsanrop i GPT-5-familjen. Gapet jämfört med 5.4 vidgas vid svåra gränsfall som villkorligt verktygsval, djupt kapslade argument och verktygsanrop som skickas efter långa resonemangsperioder.

Första försöket till kodredigeringar

Starkaste patchkvaliteten i GPT-5-familjen. Det rätta valet när en agent måste modifiera kod som måste fortsätta att kompilera och klara tester, särskilt när patchen sträcker sig över flera filer. Leverantörsrapporterade SWE-bench Verified återspeglar detta direkt.

Datoranvändning

Betydligt mer tillförlitlig än 5.4 på GUI-sekvenser i flera steg, vilket är vad OSWorld-deltan fångar. Använd den när agenten driver en webbläsare eller skrivbordsapp över dussintals steg och kostnaden för ett avbrott mitt i körningen är hög.

Hastighet

Långsammare än 5.4 och märkbart långsammare än 5.4 Mini. Cirka 70 tokens/sek vid medelhög ansträngning per Artificial Analysis. Reservera den för de steg som faktiskt behöver den extra resonemangsdjupet och kör lättare nivåer parallellt.

Hallucinationsbeteende

GPT-5.5 har OpenAI:s strängare kalibrering från GPT-5-generationen och tenderar att erkänna osäkerhet snarare än att fabulera, vilket är anledningen till att produktionsteam fortsätter att betala premien för höginsatsresonemang trots billigare alternativ som DeepSeek V4 Pro som nu matchar den på benchmarks.

Bästa agentuppgifter för GPT-5.5

Orkestratören som kör en plan med flera verktyg

Använd GPT-5.5 som planerare som bryter ner en kundförfrågan i tio steg, skickar varje steg till en GPT-5.4- eller 5.4 Mini-nivå underagent, och sammanfogar resultaten. Att köra 5.5 endast på planeringsnivån (och de billigare nivåerna överallt annars) kostar en bråkdel av att köra 5.5 från början till slut, med det mesta av kvaliteten bevarad.

De första kodredigeringarna som inte slösar bort en CI-körning

Be GPT-5.5 att migrera en kodbas med 50 filer från en ORM till en annan, refaktorera en trasslig modul eller tillämpa en säkerhetsfix över hela repot. Patchen tillämpas rent vid första försöket oftare än någon annan modell i familjen, och det är precis vad din CI-faktura kommer att återspegla.

Datoranvändningsagenten som måste slutföra arbetsflödet

När agenten driver en webbläsare genom ett flerstegs bokningsflöde, en skrivbordsapp eller ett äldre administrativt användargränssnitt, leder 5.5:s starkare OSWorld-poäng till färre avbrott mitt i körningen och färre mänskliga övertaganden. Premien betalar sig själv första gången en lång session inte behöver startas om.

Det hårda matematik- eller naturvetenskapliga forskningssteget

Släpp in en tävlingsklassad matteuppgift eller en avancerad fysikderivation så kommer 5.5 att lösa den utan de "off-by-one"-fel du ser i 5.4. AIME 2025 och GPQA Diamond fångar exakt denna typ av beteende.

När man ska hoppa över GPT-5.5

Hoppa över GPT-5.5 för rutinmässigt arbete med hög volym där GPT-5.4 uppnår samma kvalitetsnivå till halva kreditkostnaden, för latenskänsliga chattrepliker där GPT-5.4 Mini är mycket snabbare, och för massklassificerings- eller extraktionsjobb där GPT-5.4 Mini är det billigare bulkalternativet som stöds.

GPT-5.5 vs andra modeller

GPT-5.5 vs GPT-5.4

GPT-5.4 är standardarbetsmaskinen i GPT-5-familjen och det rätta valet för de flesta agenter. Uppgradera till GPT-5.5 endast när 5.4 synligt misslyckas med svår resonemang, långa agentiska loopar eller kodredigeringar på första försöket, vanligtvis som orkestratör som delegerar nedåt till 5.4- eller 5.4 Mini-nivåns underagenter.

GPT-5.5 vs Claude Opus 4.7

Samma roll i olika familjer: den höginsatsorkestratören och modellen du eskalerar till när den billigare nivån misslyckas. Opus 4.7 har 1M-token kontextfönstret och Anthropic:s säkerhetsprofil; GPT-5.5 har starkare datoranvändningspoäng och är det naturliga valet för team som redan använder Codex-ramverket. Välj baserat på vilket ramverk och ekosystem dina befintliga agenter riktar sig mot.

GPT-5.5 vs Gemini 3 Pro

Gemini 3 Pro leder inom rå långkontextresonemang (2M-tokenfönster) och på vissa multimodala benchmarks. GPT-5.5 leder inom agentisk kodning (SWE-bench Verified, Terminal-Bench) och datoranvändning. Välj GPT-5.5 när agenten redigerar kod eller driver ett användargränssnitt; välj Gemini 3 Pro när arbetsbelastningen är tung dokument- eller videoförståelse.

Slutsats: ska du använda GPT-5.5?

GPT-5.5 är eskaleringstjänsten på OpenAI-sidan. Standard är GPT-5.4; uppgradera till 5.5 endast vid de specifika steg där 5.4 synbart misslyckas.

Vanliga frågor

Vad är GPT-5.5:s kontextfönster?

400 000 tokens, med upp till 128K tokens utdata per svar. Hela fönstret faktureras till standardpriser.

Kan GPT-5.5 hantera bilder?

Ja. GPT-5.5 är multimodal. Den accepterar bildinmatningar tillsammans med text och kod, så skärmbildsdrivna och dokumentvisionsagenter fungerar nativt. För bildgenerering använd OpenAI Images API.

När ska jag välja GPT-5.5 framför GPT-5.4?

När (a) agenten är planeraren/orkestratören och beslut kaskaderar, (b) körningen är tillräckligt lång för att 5.4 börjar feldirigera verktygsanrop, eller (c) utdata måste tillämpas rent vid första försöket (kodredigeringar, strukturerade nyttolaster, datoranvändningsarbetsflöden).

Stöder GPT-5.5 promptcaching?

Ja. Cachad input faktureras till 0,50 USD per 1 miljon tokens – en 10× rabatt på den cachade delen. Värt att använda när din systemprompt eller verktygsschema är stabilt över anrop.

Vilket ramverk använder GPT-5.5 på Okou?

Codex. Okou dirigerar GPT-5.5 genom Codex-ramverkets Responses API-yta, vilket är vad codex CLI använder som standard. Claude Code-ramverksagenter är inte kompatibla med GPT-5-modeller på Okou.

Alternativ

Använder GPT-5.5 på Okou

Två sätt att komma åt GPT-5.5 på Okou

Okou stöder GPT-5.5 som en inbyggd modell som faktureras i Okou-krediter, och genom att ta med egen med en OpenAI API key. Den inbyggda vägen använder Okou hanterad routing och den prisnivå som förklaras nedan; den egna vägen fakturerar dig direkt med den uppströms leverantören och hoppar över Okou-kreditkonverteringen helt.

Okou:s rekommendation

Okou positionerar GPT-5.5 som en kärnagentmodell för orkestrering, kodrelaterat arbete och andra steg där ett felaktigt svar är kostsamt.

Krediter och $$$ prisnivå

Okou prissätter varje inbyggd modell på en fyrstegs kreditsskala – $, $$, $$$, $$$$ – som visas som ett märke i modellväljaren och på price tier-raden i zero model ls. GPT-5.5 ligger på $$$. Den nivån är vad du spenderar från ditt Okou-kreditbalans; leverantörens listpris i tabellen ovan är vad den uppströms leverantören debiterar innan Okou konverterar det till krediter.

Tillgänglig på Okou sedan April 2026.