Alle modeller

GPT 5.6 Luna på Okou. Den raske, økonomiske GPT-5.6-nivået

Økonominivået i OpenAIs GPT-5.6 forhåndsvisningsfamilie. Rask, billig og multimodal – bygget for verktøybruk med høyt volum, bulk-arbeid og latensfølsomme svar.

400K tokens · Text / Vision / Code · Prompt cache

GPT 5.6 Luna er økonominivået i OpenAIs GPT-5.6 forhåndsvisningsgenerasjon – det raske, billige medlemmet av familien bygget for verktøybruk med høyt volum, bulkkategorisering og -utvinning, og latensfølsom chat der hastighet og kostnad betyr mer enn grensesprengende resonneringsdybde.

Leverandørens listepris er $0.20 / $1.20 per 1M tokens med bufret input til $0.02 / 1M – den laveste i GPT-5.6-familien. Den ligger i Okous økonomikredittbånd, noe som gjør den til nivået å strekke seg etter for den brede basen av rutinearbeid, mens GPT 5.6 Terra håndterer den daglige agenten og Sol tar bare de vanskeligste trinnene. GPT-5.6 er for øyeblikket en forhåndsvisningsfamilie; GPT-5.5 forblir standard OpenAI-modell til den er ferdig.

Hva er GPT 5.6 Luna?

Juli 2026 forhåndsvisning (økonominivå av GPT-5.6-familien) · Økonomi-nivået i GPT-5.6-familien, under Sol og Terra. Det raske, rimelige alternativet for store volumer og latensfølsomt arbeid.

GPT-5.6 ble lansert i juli 2026 som en familie med tre nivåer – Sol, Terra og Luna. Luna er økonominivået: OpenAI posisjonerer den for den store volum-, latenssensitive basen av en agents arbeidsmengde, rollen GPT-5.4 Mini spilte i forrige generasjon. Den beholder 400K-token kontekstvinduet og reasoning_effort-parameteren i familien, slik at den kan brukes i eksisterende Codex-agenter uten endringer.

Luna bytter toppresonnement for hastighet og kostnad. Til $0.20 / $1.20 per 1M tokens, etter OpenAIs 80 % prisreduksjon 30. juli 2026, er den en brøkdel av Sols pris og det billigste støttede GPT-5.6-nivået på Okou. I OpenAIs forhåndsvisningsmateriale holder den seg godt på enkle verktøybruk, klassifisering og ekstraksjon, og faller bare meningsfullt bak på de vanskelige resonnement- og langløkkeoppgavene som uansett hører hjemme på Terra eller Sol.

Som med resten av forhåndsvisningsfamilien er tallene tidlige og retningsgivende. Det som er stabilt, er Lunas rolle: det er nivået du kjører på den brede basen av en pipeline – mange billige, raske samtaler – mens du promoterer den lille brøkdelen av genuint vanskelige trinn til Terra og Sol. Denne lagdelingen er det som gjør en GPT-5.6-agent både kapabel og rimelig.

Hva er bemerkelsesverdig med GPT 5.6 Luna

Overskriftsarkitektur og funksjonsfunksjoner.

GPT 5.6 Luna beholder kontekstvinduet på 400K-token, fakturert til standard inndatapriser over hele vinduet. Den støtter reasoning_effort-parameteren, hurtigbuffer for prompter der hurtigbufret inndata faktureres til en tidel av inndatasatsen ($0.02 / 1M) pluss en hurtigbuffer-skriveavgift ($0.25 / 1M), og Responses API-overflaten som codex CLI bruker som standard. Verktøybruk, strukturerte utdata og datamaskinbruk samsvarer med resten av GPT-5.6-familien. Inndata er multimodale på tvers av tekst, visjon og kode; det er ingen innebygd bildegenerering.

Spesifikasjoner på et øyeblikk

FamilieGPT-5.6 generasjon (forhåndsvisning)
ModaliteterTekst, syn, kode
SpråkEngelsk-først, flerspråklig
LedetekstbufringStøttet (OpenAI)
Kontekstvindu400K tokens
Maks utdataOpptil 128K tokens
ResonneringsinnsatsMinimal / Lav / Middels / Høy
Leverandørens listepris$0.20 input / $1.20 output per 1M

GPT 5.6 Luna referansepunkter

Forhåndsvisningsdata fra OpenAIs GPT-5.6-materialer, vist mot de offentlige GPT-5.4 Mini-tallene Luna lykkes med. Behandle alle prosenter som retningsgivende: familien er i forhåndsvisning, og OpenAI har flagget SWE-bench Verified-kontaminering på tvers av grensemodeller.

SWE-bench Verifiedforhåndsvisning; økonomi-nivå
~70%
Terminal-Bench 2.0forhåndsvis verktøybruk
~58%
AIME 2025 (ingen verktøy)forhåndsvisning av konkurransematematikk
~89%
GPQA Diamondforhåndsvisning av avansert vitenskap
~80%
OSWorld (datamaskinbruk)forhåndsvisning
~62%
MMMU (multimodal)forhåndsvisning
Entry GPT-5.6-familien
Hastighetmiddels innsats, tidlig estimat
~130 tokens/sek

GPT 5.6 Luna priser

Leverandørens listepris, per 1M tokens.

Inndata$0.20
Utdata$1.20
Cache-lesing$0.02
Cache-skriving$0.25

Hvordan GPT 5.6 Luna oppfører seg i praksis

Observert atferd fra produksjonsagentkjøringer.

Hastighet

Det raskeste nivået i GPT-5.6-familien – rundt 130 tokens/sekund ved middels innsats i tidlig testing. Dette er grunnen til å velge Luna: interaktive svar og høygjennomstrømnings-pipelines forblir responsive.

Verktøyruting

Pålitelig på enkle og moderat strukturerte verktøyanrop. Den taper terreng til Terra på betinget valg og til Sol på verktøyanrop sendt etter lang resonnement – behold disse trinnene på de høyere nivåene.

Masseklassifisering og -ekstraksjon

Riktig nivå for å kjøre den samme strukturerte prompten på tvers av tusenvis av elementer. Multimodal input betyr at den håndterer skjermbilde- og dokumentdrevet utvinning, ikke bare tekst.

Resonneringsdybde

Lettere enn Terra og Sol på vanskelig flertrinnsresonnement og lange agentiske løkker. Bruk den for bredde, ikke dybde: mange billige, raske samtaler, med de vanskelige trinnene fremmet oppover.

Kostnadsprofil

$0.20 / $1.20 per 1M og økonomikredittbåndet gjør Luna til det billigste GPT-5.6-nivået – modellen du kjører på den brede basen av en pipeline der volum, ikke grense-resonnement, driver regningen.

Beste agentoppgaver for GPT 5.6 Luna

Høyvolumklassifisering og tagging

Kjør Luna på tvers av tusenvis av billetter, e-poster eller dokumenter for å merke, rute eller trekke ut felt. Til $0.20 / $1.20 forblir kostnaden per element lav, og multimodal inndata dekker skjermbilde- og PDF-drevne jobber.

Latensfølsomme chat-svar

For en brukerrettet assistent der responstiden merkes direkte, holder Lunas ~130 tokens/sekund svarene raske, samtidig som den håndterer verktøyanrop og strukturerte utdata.

Grunnlaget under Terra og Sol

I en lagdelt agent håndterer Luna de mange billige, raske trinnene – henting, formatering, enkle verktøykall – mens Terra kjører den daglige logikken og Sol tar den vanskeligste planleggingen. Lagdelingen holder hele pipelinen rimelig.

Utkast-deretter-forbedre-sløyfer

La Luna produsere raske første utkast – disposisjoner, kandidatkode, sammendrag – og promoter kun de som trenger polering til Terra eller Sol. Du betaler grenseprisen på en brøkdel av volumet.

Når du skal hoppe over GPT 5.6 Luna

Hopp over Luna på de vanskeligste refaktoriseringene av flere filer, lange orkestreringsløkker og resonnement på høyere nivå, der Terra og spesielt Sol gjør det vesentlig bedre. Når kvaliteten på første forsøk eller dyp resonnement er poenget, er økonomiklassen en falsk økonomi.

GPT 5.6 Luna vs andre modeller

GPT 5.6 Luna vs GPT 5.6 Terra

Terra er den balanserte hverdagsstandarden; Luna er økonominivået under. Luna er raskere og en tidel av Terras listepris, men gir opp resonnementsdybde og hard verktøyruting. Kjør Luna for volum og latens; gå opp til Terra i det øyeblikket en oppgave krever ekte resonnement.

GPT 5.6 Luna vs GPT-5.4 Mini

Luna er GPT-5.6-etterfølgeren til GPT-5.4 Mini i økonomisporet, med den nyere generasjonens verktøybruk og multimodal input. Den er nå oppført godt under den ($0.20 / $1.20 vs $0.75 / $4.50), omtrent en fjerdedel av prisen, og bringer GPT-5.6-forbedringene til det billige, raske nivået.

GPT 5.6 Luna vs Claude Sonnet 4.6

Forskjellige familier, overlappende økonomi-til-balansert rolle. Sonnet 4.6 bringer 1M-token kontekstvinduet og Anthropics økosystem; Luna bringer Codex-rammeverket, raskere generering og en lavere pris. Velg etter rammeverk, kontekstlengde og hvor mye du verdsetter hastighet over resonnementsdybde.

Konklusjon: bør du bruke GPT 5.6 Luna?

GPT 5.6 Luna er den raske, billige basen i GPT-5.6-familien: kjør den for høyvolum- og latenssensitive oppgaver, og promoter de genuint vanskelige trinnene til Terra og Sol.

Ofte stilte spørsmål

Hva er GPT 5.6 Lunas kontekstvindu?

400 000 tokens, med opptil 128K tokens utdata per svar. Hele vinduet faktureres til standardpriser.

Når bør jeg bruke Luna i stedet for Terra?

Når hastighet og kostnad betyr mer enn resonnementsdybde: høyvolumklassifisering og -ekstraksjon, latensfølsom chat og det billige grunnlaget for en lagdelt agent. Gå opp til Terra i det øyeblikket en oppgave krever ekte flertrinnsresonnement eller hard verktøyruting.

Er GPT-5.6 generelt tilgjengelig på Okou?

Den er i forhåndsvisning. Alle tre nivåene kan velges, men GPT-5.5 forblir standard OpenAI-modell til GPT-5.6-familien er ferdig, og forhåndsvisningsbenchmark-tallene er tidlige.

Støtter GPT 5.6 Luna hurtigbufring av prompter?

Ja. Bufret input faktureres til $0,02 per 1M tokens med en cache-skrivekostnad på $0,25 per 1M – den billigste bufringen i familien. Verdt å aktivere på enhver agent med et stabilt prefiks.

Hvilket rammeverk bruker GPT 5.6 Luna på Okou?

Codex. Okou ruter GPT-5.6 gjennom Codex-rammeverkets Responses API-overflate. Claude Code-rammeverksagenter er ikke kompatible med GPT-5-modeller på Okou.

Alternativer

Bruker GPT 5.6 Luna på Okou

To måter å få tilgang til GPT 5.6 Luna på Okou

Okou støtter GPT 5.6 Luna som en innebygd modell fakturert i Okou-kreditter, og gjennom bring-your-own med en OpenAI API key. Den innebygde veien bruker Okou Managed-ruting og prisnivået forklart nedenfor; bring-your-own-veien fakturerer deg direkte med den oppstrøms leverandøren og hopper over Okou-kredittkonverteringen helt.

Okous anbefaling

Okou posisjonerer GPT 5.6 Luna som et kostnadsbesparende alternativ for massekategorisering, forhåndsfiltre, latenssensitive svar og annet høyvolumsarbeid.

Kreditter og $ prisnivå

Okou priser hver innebygde modell på en fire-trinns kredittskala – $, $$, $$$, $$$$ – vist som et merke i modellvelgeren og på price tier-linjen i zero model ls. GPT 5.6 Luna ligger på $. Det nivået er det du bruker fra din Okou-kredittsaldo; leverandørens listepris i tabellen ovenfor er det oppstrømsleverandøren tar før Okou konverterer det til kreditter.

Tilgjengelig på Okou siden July 2026 (preview).