GPT 5.6 Luna på Okou. Den hurtige, økonomiske GPT-5.6-tier
Økonomi-tieret af OpenAI's GPT-5.6 preview-familie. Hurtig, billig og multimodal – bygget til stor volumen værktøjsbrug, bulk-arbejde og latensfølsomme svar.
400K tokens · Text / Vision / Code · Prompt cache
GPT 5.6 Luna er økonomi-niveauet af OpenAI's GPT-5.6 forhåndsvisningsgeneration – det hurtige, billige medlem af familien bygget til værktøjsbrug i store mængder, bulkklassificering og -udtrækning samt latenstidssensitiv chat, hvor hastighed og omkostninger betyder mere end banebrydende ræsonnementsdybde.
Leverandørens listepris er $0.20 / $1.20 pr. 1M tokens med cachelagret input til $0.02 / 1M – den laveste i GPT-5.6-familien. Den ligger i Okou's økonomiske kreditbånd, hvilket gør den til det niveau, man skal vælge til den brede base af rutinearbejde, mens GPT 5.6 Terra håndterer den daglige agent, og Sol kun tager de sværeste trin. GPT-5.6 er i øjeblikket en forhåndsvisningsfamilie; GPT-5.5 forbliver standard OpenAI-modellen, indtil den er færdigudviklet.
Hvad er GPT 5.6 Luna?
Juli 2026 forhåndsvisning (økonomi-niveau af GPT-5.6-familien) · Økonomi-niveau af GPT-5.6-familien, under Sol og Terra. Den hurtige, billige mulighed for arbejde med høj volumen og latenstidfølsomhed.
GPT-5.6 blev lanceret i juli 2026 som en familie i tre niveauer – Sol, Terra og Luna. Luna er økonominiveauet: OpenAI positionerer den til den store volumen, latency-følsomme base af en agents arbejdsbyrde, den rolle GPT-5.4 Mini spillede i den tidligere generation. Den bevarer 400K-token kontekstvinduet og reasoning_effort-parameteren i familien, så den passer ind i eksisterende Codex-agenter uden ændringer.
Luna bytter top-end ræsonnement for hastighed og omkostninger. Til $0,20 / $1,20 pr. 1M tokens, efter OpenAI's 80% prisnedsættelse den 30. juli 2026, er det en brøkdel af Sols pris og det billigste understøttede GPT-5.6-niveau på Okou. I OpenAI's forhåndsvisningsmateriale holder den sig godt på ligetil værktøjsbrug, klassificering og udtrækning, og falder kun meningsfuldt bagud på de hårde ræsonnements- og langløbsopgaver, der alligevel hører hjemme på Terra eller Sol.
Som med resten af preview-familien er tallene tidlige og retningsgivende. Hvad der er stabilt, er Lunas rolle: det er det niveau, du kører i den brede base af en pipeline – mange billige, hurtige opkald – mens du promoverer den lille brøkdel af ægte svære trin til Terra og Sol. Denne lagdeling er det, der holder en GPT-5.6-agent både kapabel og overkommelig.
Hvad er bemærkelsesværdigt ved GPT 5.6 Luna
Overskriftsarkitektur og kapacitetsfunktioner.
GPT 5.6 Luna bevarer det 400K-token kontekstvindue, faktureret til standard inputpriser over hele vinduet. Den understøtter reasoning_effort-parameteren, prompt-caching hvor cachelagret input faktureres til en tiendedel af inputprisen ($0.02 / 1M) plus et cache-skrivegebyr ($0.25 / 1M), og Responses API-overfladen, som codex CLI bruger som standard. Værktøjsbrug, strukturerede outputs og computerbrug matcher resten af GPT-5.6-familien. Input er multimodale på tværs af tekst, vision og kode; der er ingen indbygget billedgenerering.
Specifikationer på et øjeblik
GPT 5.6 Luna benchmarks
Forhåndsvisningsdata fra OpenAI's GPT-5.6-materialer, vist i forhold til de offentlige GPT-5.4 Mini-tal, som Luna efterfølger. Behandl alle procenter som retningsgivende: familien er i forhåndsvisning, og OpenAI har markeret SWE-bench Verified-kontamination på tværs af frontier-modeller.
GPT 5.6 Luna priser
Udbyderens listepris, pr. 1M tokens.
Hvordan GPT 5.6 Luna opfører sig i praksis
Observeret adfærd fra produktionsagentkørsler.
Hastighed
Det hurtigste niveau i GPT-5.6-familien – omkring 130 tokens/sekund ved medium indsats i tidlige tests. Dette er grunden til at vælge Luna: interaktive svar og højtydende pipelines forbliver responsive.
Værktøjsrouting
Pålidelig på ligefremme og moderat strukturerede værktøjskald. Den taber terræn til Terra på betinget valg og til Sol på værktøjskald, der sendes efter lang ræsonnement – hold disse trin på de højere niveauer.
Bulk klassificering og ekstraktion
Det rigtige niveau til at køre den samme strukturerede prompt på tværs af tusindvis af elementer. Multimodal input betyder, at det håndterer skærmbillede- og dokumentdrevet udtrækning, ikke kun tekst.
Begrundelsesdybde
Lettere end Terra og Sol på hård multi-trins ræsonnement og lange agentiske loops. Brug den til bredde, ikke dybde: mange billige hurtige kald, med de hårde trin promoveret opad.
Omkostningsprofil
0,20 $ / 1,20 $ pr. 1M og økonomikreditbåndet gør Luna til den billigste GPT-5.6-tier — den model, du kører i den brede base af en pipeline, hvor volumen, ikke grænseoverskridende ræsonnement, driver regningen.
Bedste agentopgaver for GPT 5.6 Luna
Højvolumen klassificering og tagging
Kør Luna på tværs af tusindvis af billetter, e-mails eller dokumenter for at mærke, dirigere eller udtrække felter. Til $0,20 / $1,20 forbliver omkostningen pr. vare lav, og multimodal input dækker skærmbillede- og PDF-drevne opgaver.
Latenstidssensitive chat-svar
For en brugerrettet assistent, hvor responstiden mærkes direkte, holder Lunas ~130 tokens/sek. svarene hurtige, samtidig med at den håndterer værktøjskald og strukturerede outputs.
Grundlaget under Terra og Sol
I en lagdelt agent håndterer Luna de mange billige, hurtige trin – hentning, formatering, simple værktøjskald – mens Terra kører den daglige logik, og Sol tager den sværeste planlægning. Lagdelingen holder hele pipelinen overkommelig.
Udkast-derefter-forfin-loops
Lad Luna producere hurtige første udkast – skitser, kandidatkode, resuméer – og promover kun dem, der skal poleres, til Terra eller Sol. Du betaler frontier-prisen på en brøkdel af volumen.
Hvornår man skal springe GPT 5.6 Luna over
Spring Luna over på de sværeste refaktoreringer af flere filer, lange orkestreringssløjfer og ræsonnement på kandidatniveau, hvor Terra og især Sol klarer sig væsentligt bedre. Når kvaliteten af første forsøg eller dyb ræsonnement er pointen, er økonomiklassen en falsk økonomi.
GPT 5.6 Luna vs. andre modeller
GPT 5.6 Luna vs GPT 5.6 Terra
Terra er den afbalancerede hverdagsstandard; Luna er økonomiklassen under den. Luna er hurtigere og en tiendedel af Terras listepris, men giver afkald på ræsonnementsdybde og hård værktøjsrouting. Kør Luna for volumen og latens; opgrader til Terra i det øjeblik en opgave kræver reel ræsonnement.
GPT 5.6 Luna vs GPT-5.4 Mini
Luna er GPT-5.6-efterfølgeren til GPT-5.4 Mini i økonomislotet, med den nyere generations værktøjsbrugsadfærd og multimodale input. Den ligger nu langt under den ($0,20 / $1,20 vs. $0,75 / $4,50), omkring en fjerdedel af prisen, og bringer GPT-5.6-forbedringerne til den billige, hurtige kategori.
GPT 5.6 Luna vs Claude Sonnet 4.6
Forskellige familier, overlappende økonomi-til-balanceret rolle. Sonnet 4.6 bringer 1M-token kontekstvinduet og Anthropic's økosystem; Luna bringer Codex-rammeværket, hurtigere generering og en lavere pris. Vælg efter rammeværk, kontekstlængde og hvor meget du værdsætter hastighed frem for ræsonnementsdybde.
Bundlinjen: skal du bruge GPT 5.6 Luna?
GPT 5.6 Luna er den hurtige, billige base i GPT-5.6-familien: kør den til højvolumen- og latenstidskritiske opgaver, og promover de ægte svære trin til Terra og Sol.
Ofte stillede spørgsmål
Hvad er GPT 5.6 Lunas kontekstvindue?
400.000 tokens, med op til 128K tokens output pr. svar. Det fulde vindue faktureres til standardpriser.
Hvornår skal jeg bruge Luna i stedet for Terra?
Når hastighed og omkostninger betyder mere end ræsonnementsdybde: højvolumenklassificering og -udtrækning, latenstidssensitiv chat og det billige basislag i en lagdelt agent. Gå op til Terra i det øjeblik en opgave kræver ægte flertrinsræsonnement eller hård værktøjsrouting.
Er GPT-5.6 generelt tilgængelig på Okou?
Den er i forhåndsvisning. Alle tre niveauer kan vælges, men GPT-5.5 forbliver standard OpenAI-modellen, indtil GPT-5.6-familien er færdig, og forhåndsvisningsbenchmark-tallene er tidlige.
Understøtter GPT 5.6 Luna prompt-caching?
Ja. Cachelagret input faktureres til $0,02 pr. 1M tokens med et cache-skrivegebyr på $0,25 pr. 1M – den billigste cachelagring i familien. Værd at aktivere på enhver agent med et stabilt præfiks.
Hvilket framework bruger GPT 5.6 Luna på Okou?
Codex. Okou router GPT-5.6 gennem Codex-rammeværkets Responses API-overflade. Claude Code-rammeværksagenter er ikke kompatible med GPT-5-modeller på Okou.
Alternativer
Bruger GPT 5.6 Luna på Okou
To måder at få adgang til GPT 5.6 Luna på Okou
Okou understøtter GPT 5.6 Luna som en indbygget model, der faktureres i Okou-kreditter, og via bring-your-own med en OpenAI API key. Den indbyggede sti bruger Okou Managed routing og den prisklasse, der er forklaret nedenfor; bring-your-own-stien fakturerer dig direkte hos den oprindelige leverandør og springer Okou-kreditkonverteringen helt over.
Okou's anbefaling
Okou positionerer GPT 5.6 Luna som en omkostningsbesparende mulighed for bulkklassificering, forfiltrering, latensfølsomme svar og andet højvolumenarbejde.
Kreditter og $ prisniveau
Okou prissætter hver indbygget model på en firetrins kredit-skala — $, $$, $$$, $$$$ — vist som et badge i modelvælgeren og på price tier-linjen i zero model ls. GPT 5.6 Luna ligger på $. Det niveau er, hvad du bruger fra din Okou-kreditbalance; leverandørens listepris i tabellen ovenfor er, hvad den opstrøms udbyder opkræver, før Okou konverterer det til kreditter.
Tilgængelig på Okou siden July 2026 (preview).

