Alle modellen

Kimi K3: Moonshot's 2.8T grensmodel

Moonshot's 2,8 biljoen-parameter Mixture-of-Experts model, met een contextvenster van 1M-token, native beeld- en video-invoer en open gewichten.

1M tokens · Text / Vision / Video / Code · Prompt cache

Okou draait geen Kimi K3. Deze pagina is een referentie voor de specificaties, prijzen en benchmarks. Voor hetzelfde soort werk op Okou vandaag, gebruik Claude Fable 5.1.

Zie Claude Fable 5.1

Kimi K3 is Moonshot AI's grensverleggende model, gelanceerd op 16 juli 2026: een sparse Mixture-of-Experts netwerk met 2,8 biljoen totale parameters, 16 van de 896 experts actief per token, een contextvenster van 1.048.576 tokens en native beeld- en video-invoer. Artificial Analysis scoorde het 57,1 op de Intelligence Index v4.1 — vierde onder de geteste configuraties, achter Claude Fable 5.1 (59,9) en GPT 5.6 Sol (58,9), vóór Claude Opus 4.8.

De catalogusprijs is $3,00 per miljoen invoertokens, $0,30 bij een cache-hit en $15,00 per miljoen uitvoertokens, vast over het hele venster zonder toeslag voor lange context. Open weights werden op 27 juli 2026 op Hugging Face geplaatst onder Moonshot's eigen Kimi K3-licentie. Okou draait Kimi K3 niet. Het dichtstbijzijnde model in het Okou-assortiment is Claude Fable 5.1, dat overeenkomt met het 1M-token venster en dezelfde Intelligence Index leidt.

Wat is Kimi K3?

16 juli 2026 · Moonshot's grenslijn. Opvolger van de Kimi K2-serie, inclusief K2.7 Code.

Kimi K3 is het grensverleggende model van Moonshot AI, onthuld op 16 juli 2026 en aangeboden via de Kimi-app en de Kimi API als kimi-k3. Het is een schaars Mixture-of-Experts-model: 2,8 biljoen totale parameters met 16 van de 896 experts actief per token, wat de inferentieprijs dicht bij een mid-tier dicht model houdt, ondanks het aantal parameters.

De sprong over de K2-lijn is het grootst bij langetermijn agentwerk. In Moonshot's lanceringssuite leidt K3 elk getest model op Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 en Automation Bench, terwijl het achterblijft bij Claude Fable 5.1 op FrontierSWE en GPT 5.6 Sol op DeepSWE. Op Artificial Analysis's GDPval-AA v2 Elo, dat economisch waardevol kenniswerk scoort, bereikt het 1668, een stijging ten opzichte van Kimi K2.6's 1190 en boven Claude Opus 4.8's 1600.

Wat is opmerkelijk aan Kimi K3

Koparchitectuur en functionaliteiten.

K3 combineert de MoE-stack met twee efficiëntiemechanismen die Moonshot Kimi Delta Attention en Attention Residuals noemt, waaraan een tot 6,3x snellere decodering wordt toegeschreven, en biedt zijn 1.048.576-tokenvenster aan tegen een enkele vaste prijs zonder context-tiering. De uitvoer bedraagt standaard 131.072 tokens en kan binnen hetzelfde venster hoger worden geconfigureerd. De invoer omvat tekst, afbeeldingen en video; de uitvoer is tekst. De API op platform.kimi.ai is OpenAI-compatibel, en de gewichten — ongeveer 594 GB in MXFP4 — zijn gepubliceerd voor zelf-hosting.

Specificaties in één oogopslag

FamilieKimi K3
Parameters2.8T totaal / 16 van 896 experts actief (MoE)
ModaliteitenTekst, afbeelding, video in; tekst uit
Contextvenster1.048.576 tokens
Max uitvoer131K tokens standaard, configureerbaar binnen het venster
LicentieKimi K3 Licentie (open gewichten, 27 juli 2026)

Kimi K3 benchmarks

Coderings-, agent- en visuele scores zijn de lanceringscijfers van Moonshot, met elk model op maximale denkprestaties; de Intelligence Index en de GDPval Elo zijn de onafhankelijke runs van Artificial Analysis. Een leverancierstabel is een plafond in plaats van een garantie, en onafhankelijke testers hebben een hallucinatiepercentage gerapporteerd dat ver boven het eigen cijfer van Moonshot ligt.

Kunstmatige Analyse Intelligentie Index v4.1onafhankelijk; #4 getest, achter Fable 5 (59.9) en GPT 5.6 Sol (58.9)
57.1
GDPval-AA v2 (Elo)onafhankelijk; boven Opus 4.8 (1600)
1668
GPQA Diamonddoor leverancier gerapporteerd
93.5
Terminal-Bench 2.1door leverancier gerapporteerd; Sol 88.8
88.3
FrontierSWEdoor leverancier gerapporteerd; Fable 5 86.6
81.2
DeepSWEdoor leverancier gerapporteerd; Sol 73.0
67.5
SWE Marathondoor leverancier gerapporteerd; top van de lanceringssuite
42.0
BrowseCompdoor leverancier gerapporteerd; top van de lanceringssuite
91.2

Kimi K3 prijzen

Catalogusprijs van de provider, per 1M tokens.

Invoer$3.00
Uitvoer$15.00
Cache lezen$0.30
Cache schrijvenNiet gefactureerd

Hoe Kimi K3 zich in de praktijk gedraagt

Gerapporteerd gedrag uit het lanceringsmateriaal van de leverancier en onafhankelijke evaluaties.

Lange-termijn agent runs

De scores waarop K3 direct leidt — SWE Marathon, Automation Bench, BrowseComp — zijn de scores die meten hoe goed men bij de taak blijft over honderden stappen, in plaats van eenmalige correctheid. Dat komt overeen met Moonshot's omschrijving van het model als een agent-engine in de eerste plaats.

Vaste 1M-token prijzen

Het volledige venster van 1.048.576 tokens wordt tegen één tarief gefactureerd, zonder toeslag boven een drempel. Het 1M-venster van GPT-5.5 daarentegen prijst invoer boven 272K tokens anders, wat zeer lange runs met één context elders duur maakt.

Kosten per taak

Artificial Analysis mat $0,94 per taak in zijn index — ongeveer de helft van Claude Opus 4.8's $1,80 en in lijn met GPT 5.6 Sol's $1,04. Moonshot noemt cache-hit rates van meer dan 90% op codeerworkloads, wat de effectieve invoerkosten naar het gecachte tarief van $0,30 trekt.

Beste agenttaken voor Kimi K3

Lezen op repository-schaal in één context

Een venster van 1M tokens voor een vaste prijs past een hele codebase, een volledig kwartaal aan supporttickets of een lange documentenset in één enkele aanvraag zonder chunking, en zonder een lange-context toeslag die aan het einde van het venster wacht.

Browsing- en onderzoeksagenten

BrowseComp 91.2 is de hoogste score in Moonshot's lanceringstabel, vóór GPT 5.6 Sol en Claude Fable 5.1. Multi-hop webonderzoek — de bron vinden, de citatie volgen, de cijfers verzoenen — is waar de agenttraining van K3 het duidelijkst naar voren komt.

Screenshot en video-invoer

K3 neemt afbeeldingen en video native op, dus QA-agenten die screenshots lezen en pijplijnen die opgenomen clips verwerken, hebben geen apart vision-model nodig dat voor het redeneermodel is geplaatst.

Wanneer Kimi K3 overslaan

Sla K3 over wanneer het werk een door de leverancier gecontroleerd veiligheidsprofiel of contractuele bedrijfsbrede ondersteuning in de VS of EU vereist; wanneer prompts kort genoeg zijn dat het cache-hit-tarief van $0,30 nooit wordt bereikt en een kostenbesparend model volstaat; en wanneer zelf-hosting het doel is — 594 GB aan MXFP4-gewichten vereist 64 of meer accelerators voor een productie-implementatie. Onafhankelijke tests hebben ook hallucinatiepercentages gemeten die ver boven het gepubliceerde cijfer van Moonshot liggen, dus feitrijke uitvoer moet nog steeds worden gecontroleerd. En specifiek op Okou is K3 helemaal geen optie.

Kimi K3 versus andere modellen

Kimi K3 vs Claude Fabel 5.1

Fable 5 leidt de Intelligence Index (59,9 tot 57,1) en FrontierSWE (86,6 tot 81,2); K3 wint Terminal-Bench 2.1, BrowseComp en SWE Marathon. Beide hebben een 1M-tokenvenster. Wat meestal de doorslag geeft, is prijs en beschikbaarheid: Fable 5 kost $10/$50 per miljoen tokens en draait op Okou, K3 kost $3/$15 en doet dat niet.

Kimi K3 vs GPT 5.6 Sol

Sol scoort 58,9 op de Intelligence Index tegenover 57,1 van K3, en wint DeepSWE (73,0 tegen 67,5) en Terminal-Bench met een half punt. K3 antwoordt met een venster van 1M tegenover 400K van Sol en een derde van de invoerprijs. De gemeten kosten per taak liggen dicht bij elkaar: $0,94 voor K3, $1,04 voor Sol.

Kimi K3 vs Claude Opus 4.8

K3 ligt voor op Opus 4.8 op de meeste agentic suites en op GDPval-AA Elo (1668 tegen 1600), voor $3/$15 tegen $5/$25. Opus 4.8 behoudt de voorsprong op betrouwbaarheid van tool-routing in productie en is beschikbaar op Okou, waar K3 dat niet is.

Kimi K3 vs Kimi K2.7 Code

K3 is de opvolger: 1M tokens aan context tegen 256K, native video-invoer en een veel hoger plafond voor agentic benchmarks — tegen ongeveer de drievoudige prijs ($3/$15 tegen $1.14/$4.80). Geen van beide draait vandaag op Okou; K2.7 Code is verwijderd en K3 is nooit toegevoegd.

Conclusie: moet je Kimi K3 gebruiken?

Het sterkste open-weight model dat tot nu toe is uitgebracht, en het eerste dat concurreert met de gesloten grens op agentwerk tegen een derde van de prijs van Fable 5. Okou draait het niet, dus lees deze pagina als referentie: voor dezelfde 1M-token agent workloads op Okou, is Claude Fable 5.1 de dichtstbijzijnde match.

Veelgestelde vragen

Kan ik Kimi K3 gebruiken op Okou?

Niet vandaag. Kimi K3 maakt geen deel uit van de Okou-modelfamilie — het kan niet worden gekozen in de chat of in een workflow, en het kan niet worden toegevoegd met uw eigen API-sleutel. Claude Fable 5.1 is het dichtstbijzijnde model dat Okou draait: hetzelfde 1M-token contextvenster en de hoogste score op dezelfde Intelligence Index.

Wanneer werd Kimi K3 uitgebracht?

Moonshot AI lanceerde Kimi K3 op 16 juli 2026 in de Kimi-app en de Kimi API, en publiceerde de open gewichten op Hugging Face op 27 juli 2026.

Wat is het contextvenster van Kimi K3?

1.048.576 tokens, inclusief invoer en uitvoer samen, vast geprijsd over het hele venster. Uitvoer is standaard 131.072 tokens en kan hoger worden geconfigureerd binnen de resterende context.

Hoeveel kost Kimi K3?

$3,00 per miljoen invoertokens bij een cachemisser, $0,30 per miljoen bij een cachehit en $15,00 per miljoen uitvoertokens, zonder toeslag voor lange context. In de Kimi-app beginnen betaalde lagen bij $19/maand voor een venster van 256K, en het volledige venster van 1M wordt ontgrendeld bij $39/maand.

Is Kimi K3 open source?

De gewichten zijn open onder Moonshot's eigen Kimi K3 Licentie, die leest als MIT met twee commerciële voorwaarden: een model-as-a-service bedrijf heeft een aparte overeenkomst met Moonshot nodig zodra de omzet $20M over een periode van 12 maanden overschrijdt, en elk product met meer dan 100 miljoen maandelijkse actieve gebruikers of $20M aan maandelijkse omzet moet "Kimi K3" in zijn interface weergeven.

Alternatieven

Beschikbaarheid van Kimi K3 op Okou.

Kimi K3 maakt geen deel uit van de Okou-modelfamilie, dus het kan niet worden gekozen in een chat of workflow, en het kan niet worden toegevoegd met je eigen API-sleutel. Claude Fable 5.1 is het dichtstbijzijnde model dat Okou vandaag draait.