Kimi K3: Moonshots 2.8T grensemodell
Moonshots 2,8 billioner-parameter Mixture-of-Experts-modell, med et 1M-token kontekstvindu, native bilde- og videoinndata, og åpne vekter.
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou kjører ikke Kimi K3. Denne siden er en referanse for spesifikasjoner, priser og ytelsesmålinger. For samme type arbeid på Okou i dag, bruk Claude Fable 5.1.
Se Claude Fable 5.1Kimi K3 er Moonshot AIs grensemodell, lansert 16. juli 2026: et sparsomt Mixture-of-Experts-nettverk med 2,8 billioner totale parametere, 16 av 896 eksperter aktive per token, et kontekstvindu på 1 048 576 tokens og native bilde- og videoinndata. Artificial Analysis scoret den 57,1 på Intelligence Index v4.1 – fjerde blant testede konfigurasjoner, bak Claude Fable 5.1 (59,9) og GPT 5.6 Sol (58,9), foran Claude Opus 4.8.
Listeprisen er 3,00 USD per million inndatatokens, 0,30 USD ved en hurtigbuffer-treff og 15,00 USD per million utdatatokens, flatt over hele vinduet uten langkonteksttillegg. Åpne vekter ble lagt ut på Hugging Face 27. juli 2026 under Moonshots egen Kimi K3-lisens. Okou kjører ikke Kimi K3. Den nærmeste modellen i Okou-serien er Claude Fable 5.1, som matcher 1M-token-vinduet og leder samme Intelligence Index.
Hva er Kimi K3?
16. juli 2026 · Moonshots grenselinje. Etterfølger til Kimi K2-serien, inkludert K2.7 Code.
Kimi K3 er Moonshot AIs grensemodell, avduket 16. juli 2026 og servert gjennom Kimi-appen og Kimi API som kimi-k3. Det er en sparsom Mixture-of-Experts-modell: 2,8 billioner totale parametere med 16 av 896 eksperter aktive per token, noe som holder inferens priset nær en middels tett modell til tross for parameterantallet.
Hoppet over K2-linjen er størst på langsiktig agentarbeid. På Moonshots lanseringspakke leder K3 alle testede modeller på Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 og Automation Bench, mens den ligger bak Claude Fable 5.1 på FrontierSWE og GPT 5.6 Sol på DeepSWE. På Artificial Analysis' GDPval-AA v2 Elo, som scorer økonomisk verdifullt kunnskapsarbeid, når den 1668, opp fra Kimi K2.6s 1190 og over Claude Opus 4.8s 1600.
Hva er bemerkelsesverdig med Kimi K3
Overskriftsarkitektur og funksjonsfunksjoner.
K3 parer MoE-stakken med to effektivitetsmekanismer Moonshot kaller Kimi Delta Attention og Attention Residuals, kreditert med opptil 6.3x raskere dekoding, og serverer sitt 1 048 576-token-vindu til en enkelt fast pris uten kontekst-tiering. Utdata kjører til 131 072 tokens som standard og kan konfigureres høyere innenfor samme vindu. Inndata dekker tekst, bilder og video; utdata er tekst. API på platform.kimi.ai er OpenAI-kompatibel, og vektene – omtrent 594 GB i MXFP4 – er publisert for selvhosting.
Spesifikasjoner på et øyeblikk
Kimi K3 referansepunkter
Koding, agent- og visuelle poengsummer er Moonshots lanseringsnumre, med hver modell på maksimal tenkeinnsats; Intelligence Index og GDPval Elo er Artificial Analysis' uavhengige kjøringer. En leverandørtabell er et tak snarere enn en garanti, og uavhengige testere har rapportert en hallusinasjonsrate godt over Moonshots eget tall.
Kimi K3 priser
Leverandørens listepris, per 1M tokens.
Hvordan Kimi K3 oppfører seg i praksis
Rapportert atferd fra leverandørens lanseringsmateriale og uavhengige evalueringer.
Langhorisont-agentkjøringer
Poengsummene K3 leder direkte på – SWE Marathon, Automation Bench, BrowseComp – er de som måler å holde seg til oppgaven over hundrevis av trinn, snarere enn enkeltskottskorrekthet. Det samsvarer med Moonshots rammeverk for modellen som en agentmotor først.
Fast 1M-token prising
Hele 1 048 576-token-vinduet faktureres til én sats, uten tillegg utover en terskel. GPT-5.5s 1M-vindu priser derimot inndata over 272K tokens annerledes, noe som gjør svært lange enkeltkontekstkjøringer dyre andre steder.
Kostnad per oppgave
Artificial Analysis målte $0,94 per oppgave på tvers av indeksen – omtrent halvparten av Claude Opus 4.8s $1,80 og i tråd med GPT 5.6 Sols $1,04. Moonshot oppgir cache-treffrater over 90 % på kodeoppgaver, noe som trekker den effektive inndatakostnaden mot den bufrede prisen på $0,30.
Beste agentoppgaver for Kimi K3
Lesing i repository-skala i én kontekst
Et 1M-token-vindu til en fast pris passer en hel kodebase, et helt kvartal med supporthenvendelser eller et langt dokumentsett inn i en enkelt forespørsel uten oppdeling, og uten et langkontekst-tillegg som venter i den andre enden av vinduet.
Nettleser- og forskningsagenter
BrowseComp 91.2 er den høyeste poengsummen i Moonshots lanseringstabell, foran GPT 5.6 Sol og Claude Fable 5.1. Multi-hop nettundersøkelser – finne kilden, følge sitatet, avstemme tallene – er der K3s agenttrening viser seg tydeligst.
Skjermbilde og videoinndata
K3 tar bilder og video naturlig, så QA-agenter som leser skjermbilder og pipelines som behandler innspilte klipp, trenger ikke en separat visjonsmodell koblet foran resonnementsmodellen.
Når du skal hoppe over Kimi K3
Hopp over K3 når arbeidet krever en leverandørrevidert sikkerhetsprofil eller kontraktsmessig bedriftsstøtte i USA eller EU; når prompter er korte nok til at $0.30 cache-hit-raten aldri slår inn og en kostnadsbesparende modell ville fungere; og når selvhosting er poenget – 594 GB med MXFP4-vekter krever 64 eller flere akseleratorer for en produksjonsdistribusjon. Uavhengig testing har også målt hallusinasjonsrater godt over Moonshots publiserte tall, så faktabasert utdata må fortsatt sjekkes. Og på Okou spesifikt er K3 ikke et alternativ i det hele tatt.
Kimi K3 vs andre modeller
Kimi K3 vs Claude Fable 5.1
Fable 5 leder Intelligence Index (59,9 til 57,1) og FrontierSWE (86,6 til 81,2); K3 tar Terminal-Bench 2.1, BrowseComp og SWE Marathon. Begge har et 1M-token-vindu. Det som vanligvis avgjør det er pris og tilgjengelighet: Fable 5 koster $10/$50 per million tokens og kjører på Okou, K3 koster $3/$15 og gjør det ikke.
Kimi K3 vs GPT 5.6 Sol
Sol scorer 58,9 på Intelligence Index mot K3s 57,1, og vinner DeepSWE (73,0 mot 67,5) og Terminal-Bench med et halvt poeng. K3 svarer med et 1M-vindu mot Sols 400K og en tredjedel av inngangsprisen. Målt kostnad per oppgave lander nært: $0,94 for K3, $1,04 for Sol.
Kimi K3 vs Claude Opus 4.8
K3 ligger foran Opus 4.8 på de fleste agentiske suiter og på GDPval-AA Elo (1668 mot 1600), til $3/$15 mot $5/$25. Opus 4.8 beholder fordelen med verktøyrutingens pålitelighet i produksjon og er tilgjengelig på Okou, der K3 ikke er det.
Kimi K3 vs Kimi K2.7 Code
K3 er etterfølgeren: 1M tokens med kontekst mot 256K, native videoinndata, og et mye høyere tak på agentiske benchmarks – til omtrent tredobbel pris ($3/$15 mot $1.14/$4.80). Ingen av dem kjører på Okou i dag; K2.7 Code ble avlistet, og K3 ble aldri lagt til.
Konklusjon: bør du bruke Kimi K3?
Den sterkeste åpen-vekt-modellen som er utgitt så langt, og den første som konkurrerer med den lukkede grensen på agentarbeid til en tredjedel av Fable 5s pris. Okou kjører den ikke, så les denne siden som referanse: for de samme 1M-token agentarbeidsmengdene på Okou, er Claude Fable 5.1 den nærmeste matchen.
Ofte stilte spørsmål
Kan jeg bruke Kimi K3 på Okou?
Ikke i dag. Kimi K3 er ikke en del av Okou-modellutvalget – den kan ikke velges i chat eller i en arbeidsflyt, og den kan ikke legges til med din egen API-nøkkel. Claude Fable 5.1 er den nærmeste modellen Okou kjører: samme 1M-token kontekstvindu, og toppscore på samme Intelligence Index.
Når ble Kimi K3 utgitt?
Moonshot AI lanserte Kimi K3 16. juli 2026 i Kimi-appen og Kimi API, og publiserte de åpne vektene på Hugging Face 27. juli 2026.
Hva er Kimi K3s kontekstvindu?
1 048 576 tokens, som dekker input og output samlet, priset flatt over hele vinduet. Output er som standard 131 072 tokens og kan konfigureres høyere innenfor den gjenværende konteksten.
Hvor mye koster Kimi K3?
$3,00 per million inndatatokens ved cache-miss, $0,30 per million ved cache-hit og $15,00 per million utdatatokens, uten langkonteksttillegg. I Kimi-appen starter betalte nivåer på $19/måned for et 256K-vindu, og hele 1M-vinduet låses opp for $39/måned.
Er Kimi K3 åpen kildekode?
Vektene er åpne under Moonshots egen Kimi K3-lisens, som ligner på MIT med to kommersielle betingelser: en modell-som-en-tjeneste-virksomhet trenger en egen avtale med Moonshot når inntektene overstiger 20 millioner dollar over en periode på 12 måneder, og ethvert produkt med over 100 millioner månedlige aktive brukere eller 20 millioner dollar i månedlige inntekter må vise «Kimi K3» i grensesnittet.
Alternativer
Tilgjengelighet av Kimi K3 på Okou
Kimi K3 er ikke en del av Okou-modellutvalget, så den kan ikke velges i chat eller i en arbeidsflyt, og den kan ikke legges til med din egen API-nøkkel. Claude Fable 5.1 er den nærmeste modellen Okou kjører i dag.

