Alle modellen

GPT 5.6 Luna op Okou. De snelle, voordelige GPT-5.6-laag

De economy-tier van OpenAI's GPT-5.6 preview-familie. Snel, goedkoop en multimodaal — gebouwd voor grootschalig toolgebruik, bulkwerk en latency-gevoelige antwoorden.

400K tokens · Text / Vision / Code · Prompt cache

GPT 5.6 Luna is de economy-tier van OpenAI's GPT-5.6 preview-generatie — het snelle, goedkope lid van de familie, gebouwd voor grootschalig toolgebruik, bulkclassificatie en -extractie, en latentiegevoelige chat waar snelheid en kosten belangrijker zijn dan diepgaande redenering.

De catalogusprijs van de leverancier is $0,20 / $1,20 per 1M tokens met gecachte invoer voor $0,02 / 1M — de laagste in de GPT-5.6-familie. Het valt in Okou's economy-creditband, wat het de tier maakt om te gebruiken voor de brede basis van routineklussen, terwijl GPT 5.6 Terra de dagelijkse agent afhandelt en Sol alleen de moeilijkste stappen neemt. GPT-5.6 is momenteel een preview-familie; GPT-5.5 blijft het standaard OpenAI-model totdat het afstudeert.

Wat is GPT 5.6 Luna?

Preview van juli 2026 (economy-tier van de GPT-5.6-familie) · Economy-tier van de GPT-5.6-familie, onder Sol en Terra. De snelle, goedkope optie voor werk met een hoog volume en latency-gevoelig werk.

GPT-5.6 werd in juli 2026 uitgebracht als een drielaagse familie — Sol, Terra en Luna. Luna is de economy-laag: OpenAI positioneert het voor de grote volumes, latency-gevoelige basis van de workload van een agent, de rol die GPT-5.4 Mini speelde in de vorige generatie. Het behoudt het 400K-token contextvenster en de reasoning_effort-parameter van de familie, zodat het zonder wijzigingen in bestaande Codex-agents kan worden gebruikt.

Luna ruilt top-end redenering in voor snelheid en kosten. Met $0.20 / $1.20 per 1M tokens, na OpenAI's 80% prijsverlaging op 30 juli 2026, is het een fractie van Sol's prijs en de goedkoopste ondersteunde GPT-5.6 tier op Okou. In OpenAI's previewmaterialen presteert het goed bij eenvoudig tool-gebruik, classificatie en extractie, en blijft het alleen significant achter bij de moeilijke redenerings- en lange-lus taken die sowieso bij Terra of Sol horen.

Net als bij de rest van de preview-familie zijn de cijfers vroeg en richtinggevend. Wat stabiel is, is de rol van Luna: het is de laag die je aan de brede basis van een pijplijn draait — veel goedkope, snelle oproepen — terwijl je de kleine fractie van echt moeilijke stappen promoot naar Terra en Sol. Die gelaagdheid zorgt ervoor dat een GPT-5.6-agent zowel capabel als betaalbaar blijft.

Wat is opmerkelijk aan GPT 5.6 Luna

Koparchitectuur en functionaliteiten.

GPT 5.6 Luna behoudt het 400K-token contextvenster, gefactureerd tegen standaard invoerprijzen over het gehele venster. Het ondersteunt de reasoning_effort-parameter, promptcaching waarbij gecachte invoer wordt gefactureerd tegen een tiende van het invoertarief ($0,02 / 1M) plus een cache-schrijfkosten ($0,25 / 1M), en de Responses API-interface die de codex CLI standaard gebruikt. Tool-gebruik, gestructureerde uitvoer en computergebruik komen overeen met de rest van de GPT-5.6-familie. Invoer is multimodaal over tekst, visie en code; er is geen native beeldgeneratie.

Specificaties in één oogopslag

FamilieGPT-5.6 generatie (preview)
ModaliteitenTekst, visie, code
TalenEngels-eerst, meertalig
Prompt cachingOndersteund (OpenAI)
Contextvenster400K tokens
Max uitvoerTot 128K tokens
RedeneerinspanningMinimaal / Laag / Gemiddeld / Hoog
Leverancierslijstprijs$0,20 invoer / $1,20 uitvoer per 1M

GPT 5.6 Luna benchmarks

Voorlopige cijfers uit de GPT-5.6-materialen van OpenAI, getoond ten opzichte van de openbare GPT-5.4 Mini-cijfers die Luna opvolgt. Behandel alle percentages als richtinggevend: de familie is in preview en OpenAI heeft SWE-bench Verified-contaminatie over grensmodellen heen gemarkeerd.

SWE-bench Geverifieerdvoorbeeld; economy-tier
~70%
Terminal-Bench 2.0voorbeeld toolgebruik
~58%
AIME 2025 (geen tools)voorbeeld concurrentie wiskunde
~89%
GPQA Diamondvoorbeeld afgestudeerde wetenschap
~80%
OSWorld (computergebruik)voorbeeld
~62%
MMMU (multimodaal)voorbeeld
Entry GPT-5.6 familie
Snelheidgemiddelde inspanning, vroege schatting
~130 tokens/sec

GPT 5.6 Luna prijzen

Catalogusprijs van de provider, per 1M tokens.

Invoer$0.20
Uitvoer$1.20
Cache lezen$0.02
Cache schrijven$0.25

Hoe GPT 5.6 Luna zich in de praktijk gedraagt

Waargenomen gedrag van productieve agentruns.

Snelheid

De snelste tier in de GPT-5.6 familie — ongeveer 130 tokens/sec bij gemiddelde inspanning in vroege tests. Dit is de reden om Luna te kiezen: interactieve antwoorden en high-throughput pipelines blijven responsief.

Toolroutering

Betrouwbaar bij eenvoudige en matig gestructureerde tool-aanroepen. Het verliest terrein aan Terra bij voorwaardelijke selectie en aan Sol bij tool-aanroepen die na lang redeneren worden verzonden — houd die stappen op de hogere niveaus.

Bulkclassificatie en -extractie

De juiste laag voor het uitvoeren van dezelfde gestructureerde prompt over duizenden items. Multimodale invoer betekent dat het screenshot- en documentgestuurde extractie verwerkt, niet alleen tekst.

Redeneerdiepte

Lichter dan Terra en Sol op harde meerstapsredenering en lange agentische loops. Gebruik het voor breedte, niet diepte: veel goedkope snelle oproepen, waarbij de moeilijke stappen naar boven worden gepromoveerd.

Kostenprofiel

$0,20 / $1,20 per 1M en de voordelige creditband maken Luna de goedkoopste GPT-5.6-laag — het model dat je gebruikt aan de brede basis van een pijplijn waar volume, niet grensverleggende redenering, de rekening bepaalt.

Beste agenttaken voor GPT 5.6 Luna

Classificatie en tagging met hoog volume

Voer Luna uit over duizenden tickets, e-mails of documenten om te labelen, routeren of velden te extraheren. Met $0,20 / $1,20 blijven de kosten per item laag, en multimodale invoer dekt taken die worden aangestuurd door schermafbeeldingen en PDF.

Latentiegevoelige chatantwoorden

Voor een gebruikersgerichte assistent waar de reactietijd direct wordt gevoeld, houdt Luna's ~130 tokens/sec de antwoorden snel, terwijl het toch tool-calls en gestructureerde outputs afhandelt.

De basislaag onder Terra en Sol

In een gelaagde agent handelt Luna de vele goedkope, snelle stappen af — ophalen, formatteren, eenvoudige tool-aanroepen — terwijl Terra de dagelijkse logica uitvoert en Sol de moeilijkste planning op zich neemt. De gelaagdheid houdt de hele pijplijn betaalbaar.

Ontwerp-dan-verfijn-lussen

Laat Luna snelle eerste concepten produceren — outlines, kandidaatcode, samenvattingen — en promoot alleen degenen die moeten worden gepolijst naar Terra of Sol. U betaalt het grenspercentage op een fractie van het volume.

Wanneer GPT 5.6 Luna overslaan

Sla Luna over bij de moeilijkste refactoring van meerdere bestanden, lange orkestratielussen en redeneringen op universitair niveau, waar Terra en vooral Sol aanzienlijk beter presteren. Wanneer de kwaliteit van de eerste poging of diepgaande redenering het punt is, is de economy-tier een valse zuinigheid.

GPT 5.6 Luna versus andere modellen

GPT 5.6 Luna vs GPT 5.6 Terra

Terra is de gebalanceerde alledaagse standaard; Luna is de voordelige tier eronder. Luna is sneller en een tiende van de catalogusprijs van Terra, maar levert in op redeneerdiepte en harde tool-routing. Gebruik Luna voor volume en latency; stap over op Terra zodra een taak echt redeneren vereist.

GPT 5.6 Luna vs GPT-5.4 Mini

Luna is de GPT-5.6 opvolger van GPT-5.4 Mini in het economy slot, met het tool-use gedrag en de multimodale input van de nieuwere generatie. Het staat nu ver daaronder geprijsd ($0.20 / $1.20 vs $0.75 / $4.50), ongeveer een kwart van de prijs, en brengt de GPT-5.6 verbeteringen naar de goedkope, snelle tier.

GPT 5.6 Luna vs Claude Sonnet 4.6

Verschillende families, overlappende economie-tot-gebalanceerde rol. Sonnet 4.6 brengt het 1M-token contextvenster en het ecosysteem van Anthropic; Luna brengt het Codex-framework, snellere generatie en een lagere prijs. Kies op basis van framework, contextlengte en hoeveel u snelheid waardeert boven redeneerdiepte.

Conclusie: moet je GPT 5.6 Luna gebruiken?

GPT 5.6 Luna is de snelle, goedkope basis van de GPT-5.6 familie: gebruik het voor werk met hoog volume en latency-gevoelig werk, en promoot de echt moeilijke stappen naar Terra en Sol.

Veelgestelde vragen

Wat is de contextvenster van GPT 5.6 Luna?

400.000 tokens, met tot 128K tokens output per antwoord. Het volledige venster wordt gefactureerd tegen standaardtarieven.

Wanneer moet ik Luna gebruiken in plaats van Terra?

Wanneer snelheid en kosten belangrijker zijn dan redeneerdiepte: grootschalige classificatie en extractie, latentiegevoelige chat en de goedkope basislaag van een gelaagde agent. Stap over op Terra zodra een taak echte meerstapsredenering of moeilijke tool-routing vereist.

Is GPT-5.6 algemeen beschikbaar op Okou?

Het is in preview. Alle drie de lagen zijn selecteerbaar, maar GPT-5.5 blijft het standaard OpenAI-model totdat de GPT-5.6-familie afstudeert, en de preview-benchmarkcijfers zijn vroeg.

Ondersteunt GPT 5.6 Luna prompt caching?

Ja. Gecachte invoer wordt gefactureerd tegen $0,02 per 1M tokens met een cache-schrijfkosten van $0,25 per 1M — de goedkoopste caching in de familie. De moeite waard om in te schakelen voor elke agent met een stabiel voorvoegsel.

Welk framework gebruikt GPT 5.6 Luna op Okou?

Codex. Okou routeert GPT-5.6 via het Responses API-oppervlak van het Codex-framework. Claude Code-framework-agents zijn niet compatibel met GPT-5-modellen op Okou.

Alternatieven

GPT 5.6 Luna gebruiken op Okou

Twee manieren om toegang te krijgen tot GPT 5.6 Luna op Okou

Okou ondersteunt GPT 5.6 Luna als een ingebouwd model dat wordt gefactureerd in Okou-credits, en via 'bring-your-own' met een OpenAI API key. Het ingebouwde pad maakt gebruik van Okou Managed routing en de hieronder uitgelegde prijscategorie; het 'bring-your-own' pad factureert u rechtstreeks bij de upstream leverancier en slaat de Okou-creditconversie volledig over.

Aanbeveling van Okou

Okou positioneert GPT 5.6 Luna als een kostenbesparende optie voor bulkclassificatie, voorfilters, latency-gevoelige antwoorden en ander werk met een hoog volume.

Credits en de $ prijscategorie

Okou prijst elk ingebouwd model op een vierstaps creditschaal — $, $$, $$$, $$$$ — weergegeven als een badge in de modelkiezer en op de price tier-regel van zero model ls. GPT 5.6 Luna bevindt zich op $. Die laag is wat je uitgeeft van je Okou-creditsaldo; de catalogusprijs van de leverancier in de bovenstaande tabel is wat de upstream-provider in rekening brengt voordat Okou het omzet in credits.

Beschikbaar op Okou sinds July 2026 (preview).