GPT 5.6 Luna på Okou. Den snabba, ekonomiska GPT-5.6-nivån
Ekonominivån i OpenAI:s GPT-5.6 förhandsvisningsfamilj. Snabb, billig och multimodal – byggd för verktygsanvändning med hög volym, bulkjobb och latenskänsliga svar.
400K tokens · Text / Vision / Code · Prompt cache
GPT 5.6 Luna är ekonominivån i OpenAI:s GPT-5.6 förhandsgranskningsgenerering – den snabba, billiga medlemmen i familjen byggd för högvolymsverktygsanvändning, massklassificering och extraktion, samt latenskänslig chatt där hastighet och kostnad är viktigare än banbrytande resonemangsdjup.
Leverantörens listpris är $0.20 / $1.20 per 1M tokens med cachad input till $0.02 / 1M – det lägsta i GPT-5.6-familjen. Den ligger i Okou:s ekonomiska kreditband, vilket gör den till den nivå att sträcka sig efter för den breda basen av rutinmässigt arbete medan GPT 5.6 Terra hanterar den vardagliga agenten och Sol tar endast de svåraste stegen. GPT-5.6 är för närvarande en förhandsgranskningsfamilj; GPT-5.5 förblir standard OpenAI-modellen tills den examen.
Vad är GPT 5.6 Luna?
Juli 2026 förhandsvisning (ekonomisk nivå av GPT-5.6-familjen) · Ekonominivå i GPT-5.6-familjen, under Sol och Terra. Det snabba, billiga alternativet för högvolyms- och latenskänsligt arbete.
GPT-5.6 lanserades i juli 2026 som en familj i tre nivåer – Sol, Terra och Luna. Luna är ekonominivån: OpenAI positionerar den för den högvolyms-, latenskänsliga basen av en agents arbetsbelastning, den roll GPT-5.4 Mini spelade i den tidigare generationen. Den behåller 400K-token kontextfönstret och reasoning_effort-parametern för familjen, så den passar in i befintliga Codex-agenter utan ändringar.
Luna byter ut toppresonemang mot snabbhet och kostnad. Med $0.20 / $1.20 per 1M tokens, efter OpenAI:s 80% prissänkning den 30 juli 2026, är det en bråkdel av Sols pris och den billigaste stödda GPT-5.6-nivån på Okou. I OpenAI:s förhandsgranskningsmaterial håller den bra på enkla verktygsanvändningar, klassificering och extraktion, och hamnar bara betydligt efter på de svåra resonemangs- och långlopps-uppgifter som ändå hör hemma på Terra eller Sol.
Liksom med resten av förhandsvisningsfamiljen är siffrorna tidiga och riktningsgivande. Vad som är stabilt är Lunas roll: det är den nivå du kör i den breda basen av en pipeline – många billiga, snabba anrop – samtidigt som du befordrar den lilla fraktionen av genuint svåra steg till Terra och Sol. Denna skiktning är vad som håller en GPT-5.6-agent både kapabel och prisvärd.
Vad är anmärkningsvärt med GPT 5.6 Luna
Rubrikarkitektur och funktionsfunktioner.
GPT 5.6 Luna behåller 400K-token kontextfönstret, fakturerat till standardinmatningspriser över hela fönstret. Den stöder reasoning_effort-parametern, promptcaching där cachad inmatning faktureras till en tiondel av inmatningspriset (0,02 USD / 1M) plus en cache-skrivningsavgift (0,25 USD / 1M), och Responses API-ytan som codex CLI använder som standard. Verktygsanvändning, strukturerade utdata och datoranvändning matchar resten av GPT-5.6-familjen. Indata är multimodala över text, vision och kod; det finns ingen inbyggd bildgenerering.
Specifikationer i korthet
GPT 5.6 Luna benchmarks
Förhandsgranskningssiffror från OpenAI:s GPT-5.6-material, visade mot de offentliga GPT-5.4 Mini-siffrorna som Luna lyckas med. Behandla alla procentsatser som riktningsgivande: familjen är i förhandsgranskning och OpenAI har flaggat SWE-bench Verified-kontamination över gränsmodeller.
GPT 5.6 Luna prissättning
Leverantörens listpris, per 1M tokens.
Hur GPT 5.6 Luna beter sig i praktiken
Observerat beteende från produktionsagentkörningar.
Hastighet
Den snabbaste nivån i GPT-5.6-familjen – cirka 130 tokens/sekund vid medelhög ansträngning i tidiga tester. Detta är anledningen att välja Luna: interaktiva svar och pipelines med hög genomströmning förblir responsiva.
Verktygsdirigering
Pålitlig vid enkla och måttligt strukturerade verktygsanrop. Den tappar mark mot Terra vid villkorligt urval och mot Sol vid verktygsanrop som skickas efter långa resonemang – behåll dessa steg på de högre nivåerna.
Massklassificering och extraktion
Rätt nivå för att köra samma strukturerade prompt över tusentals objekt. Multimodal input innebär att den hanterar skärmbilds- och dokumentdriven extraktion, inte bara text.
Resonemangsdjup
Lättare än Terra och Sol när det gäller svår flerstegsresonemang och långa agentloopar. Använd den för bredd, inte djup: många billiga snabba anrop, med de svåra stegen uppflyttade.
Kostnadsprofil
0,20 USD / 1,20 USD per 1M och ekonomisk kreditband gör Luna till den billigaste GPT-5.6-nivån – modellen du kör vid den breda basen av en pipeline där volym, inte gränsöverskridande resonemang, driver räkningen.
Bästa agentuppgifter för GPT 5.6 Luna
Högvolymklassificering och taggning
Kör Luna över tusentals biljetter, e-postmeddelanden eller dokument för att märka, dirigera eller extrahera fält. Till $0.20 / $1.20 förblir kostnaden per objekt låg, och multimodal input täcker skärmbilds- och PDF-drivna jobb.
Latenskänsliga chattrepliker
För en användarorienterad assistent där svarstiden känns direkt, håller Lunas ~130 tokens/sek svar snabba samtidigt som den hanterar verktygsanrop och strukturerade utdata.
Grundlagret under Terra och Sol
I en skiktad agent hanterar Luna de många billiga, snabba stegen – hämtning, formatering, enkla verktygsanrop – medan Terra kör den vardagliga logiken och Sol tar den svåraste planeringen. Skiktningen håller hela pipelinen prisvärd.
Utkast-sedan-förfina-loopar
Låt Luna producera snabba första utkast – dispositioner, kandidatkod, sammanfattningar – och befordra endast de som behöver putsas till Terra eller Sol. Du betalar gränspriset för en bråkdel av volymen.
När man ska hoppa över GPT 5.6 Luna
Hoppa över Luna vid de svåraste omstruktureringarna av flera filer, långa orkestreringsslingor och resonemang på avancerad nivå, där Terra och särskilt Sol presterar betydligt bättre. När kvaliteten på första försöket eller djupt resonemang är poängen, är ekonominivån en falsk ekonomi.
GPT 5.6 Luna vs andra modeller
GPT 5.6 Luna vs GPT 5.6 Terra
Terra är den balanserade vardagsstandarden; Luna är ekonominivån under den. Luna är snabbare och en tiondel av Terras listpris, men ger upp resonemangsdjup och hård verktygsrouting. Kör Luna för volym och latens; gå upp till Terra så fort en uppgift kräver verkligt resonemang.
GPT 5.6 Luna vs GPT-5.4 Mini
Luna är GPT-5.6-efterföljaren till GPT-5.4 Mini i ekonomislotet, med den nyare generationens verktygsanvändningsbeteende och multimodala input. Den listas nu långt under den ($0.20 / $1.20 vs $0.75 / $4.50), ungefär en fjärdedel av priset, och för med sig GPT-5.6-förbättringarna till den billiga, snabba nivån.
GPT 5.6 Luna vs Claude Sonnet 4.6
Olika familjer, överlappande ekonomi-till-balanserad roll. Sonnet 4.6 erbjuder 1M-token kontextfönstret och Anthropic:s ekosystem; Luna erbjuder Codex-ramverket, snabbare generering och ett lägre pris. Välj efter ramverk, kontextlängd och hur mycket du värderar hastighet framför resonemangsdjup.
Slutsats: ska du använda GPT 5.6 Luna?
GPT 5.6 Luna är den snabba, billiga basen i GPT-5.6-familjen: kör den för högvolym- och latenskänsligt arbete, och befordra de genuint svåra stegen till Terra och Sol.
Vanliga frågor
Vad är GPT 5.6 Lunas kontextfönster?
400 000 tokens, med upp till 128K tokens utdata per svar. Hela fönstret faktureras till standardpriser.
När ska jag använda Luna istället för Terra?
När hastighet och kostnad är viktigare än resonemangsdjup: högvolymklassificering och extraktion, latenskänslig chatt och det billiga baslagret i en skiktad agent. Gå upp till Terra i samma ögonblick som en uppgift kräver verkligt flerstegsresonemang eller hård verktygsdirigering.
Är GPT-5.6 allmänt tillgänglig på Okou?
Den är i förhandsgranskning. Alla tre nivåer är valbara, men GPT-5.5 förblir standardmodellen för OpenAI tills GPT-5.6-familjen har examen, och förhandsgranskningsresultaten är tidiga.
Stöder GPT 5.6 Luna prompt-caching?
Ja. Cachelagrad inmatning debiteras med 0,02 USD per 1 miljon tokens med en cache-skrivningsavgift på 0,25 USD per 1 miljon – den billigaste cachelagringen i familjen. Värt att aktivera på alla agenter med ett stabilt prefix.
Vilket ramverk använder GPT 5.6 Luna på Okou?
Codex. Okou dirigerar GPT-5.6 genom Codex-ramverkets Responses API-yta. Claude Code-ramverksagenter är inte kompatibla med GPT-5-modeller på Okou.
Alternativ
Använder GPT 5.6 Luna på Okou
Två sätt att komma åt GPT 5.6 Luna på Okou
Okou stöder GPT 5.6 Luna som en inbyggd modell som faktureras i Okou-krediter, och genom att ta med egen med en OpenAI API key. Den inbyggda vägen använder Okou hanterad routing och den prisnivå som förklaras nedan; den egna vägen fakturerar dig direkt med den uppströms leverantören och hoppar över Okou-kreditkonverteringen helt.
Okou:s rekommendation
Okou positionerar GPT 5.6 Luna som ett kostnadsbesparande alternativ för massklassificering, förfiltrering, latenskänsliga svar och annat högvolymsarbete.
Krediter och $ prisnivå
Okou prissätter varje inbyggd modell på en fyrstegs kreditsskala – $, $$, $$$, $$$$ – som visas som ett märke i modellväljaren och på price tier-raden i zero model ls. GPT 5.6 Luna ligger på $. Den nivån är vad du spenderar från ditt Okou-kreditbalans; leverantörens listpris i tabellen ovan är vad den uppströms leverantören debiterar innan Okou konverterar det till krediter.
Tillgänglig på Okou sedan July 2026 (preview).

