Kimi K3: Moonshots 2.8T frontier-model
Moonshots 2,8 billioner-parameter Mixture-of-Experts-model, med et 1M-token kontekstvindue, native billed- og videoinput og åbne vægte.
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou kører ikke Kimi K3. Denne side er en reference for dens specifikationer, priser og benchmarks. For den samme type arbejde på Okou i dag, brug Claude Fable 5.1.
Se Claude Fable 5.1Kimi K3 er Moonshot AI's frontlinjemodel, lanceret den 16. juli 2026: et sparsomt Mixture-of-Experts-netværk med 2,8 billioner samlede parametre, 16 af 896 aktive eksperter pr. token, et 1.048.576-token kontekstvindue og native billed- og videoinput. Artificial Analysis scorede den 57,1 på Intelligence Index v4.1 – fjerde blandt testede konfigurationer, bag Claude Fable 5.1 (59,9) og GPT 5.6 Sol (58,9), foran Claude Opus 4.8.
Listeprisen er 3,00 USD pr. million input-tokens, 0,30 USD ved et cache-hit og 15,00 USD pr. million output-tokens, fast over hele vinduet uden tillæg for lang kontekst. Åbne vægte blev lagt op på Hugging Face den 27. juli 2026 under Moonshots egen Kimi K3-licens. Okou kører ikke Kimi K3. Den nærmeste model i Okou-serien er Claude Fable 5.1, som matcher 1M-token-vinduet og fører samme Intelligence Index.
Hvad er Kimi K3?
16. juli 2026 · Moonshots grænselinje. Efterfølger til Kimi K2-serien, inklusive K2.7 Code.
Kimi K3 er Moonshot AI's frontlinjemodel, afsløret den 16. juli 2026 og serveret via Kimi-appen og Kimi API som kimi-k3. Det er en sparsom Mixture-of-Experts-model: 2,8 billioner samlede parametre med 16 af 896 eksperter aktive pr. token, hvilket er det, der holder inferens prissat nær en mellemliggende tæt model på trods af parameterantallet.
Springet over K2-linjen er størst på langtidsagentarbejde. På Moonshots lanceringssuite fører K3 alle testede modeller på Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 og Automation Bench, mens den halter efter Claude Fable 5.1 på FrontierSWE og GPT 5.6 Sol på DeepSWE. På Artificial Analysis's GDPval-AA v2 Elo, som scorer økonomisk værdifuldt vidensarbejde, når den 1668, op fra Kimi K2.6's 1190 og over Claude Opus 4.8's 1600.
Hvad er bemærkelsesværdigt ved Kimi K3
Overskriftsarkitektur og kapacitetsfunktioner.
K3 parrer MoE-stakken med to effektivitetsmekanismer, Moonshot kalder Kimi Delta Attention og Attention Residuals, krediteret med op til 6.3x hurtigere afkodning, og serverer sit 1.048.576-token vindue til en enkelt fast pris uden kontekst-tiering. Output kører som standard op til 131.072 tokens og kan konfigureres højere inden for samme vindue. Input dækker tekst, billeder og video; output er tekst. API på platform.kimi.ai er OpenAI-kompatibel, og vægtene — ca. 594 GB i MXFP4 — er offentliggjort til selv-hosting.
Specifikationer på et øjeblik
Kimi K3 benchmarks
Kodning, agent- og visuelle scores er Moonshots lanceringsnumre, med hver model på maksimal tænkeindsats; Intelligence Index og GDPval Elo er Artificial Analysis' uafhængige kørsler. En leverandørtabel er et loft snarere end en garanti, og uafhængige testere har rapporteret en hallucinationsrate langt over Moonshots eget tal.
Kimi K3 priser
Udbyderens listepris, pr. 1M tokens.
Hvordan Kimi K3 opfører sig i praksis
Rapporteret adfærd fra leverandørens lanceringsmateriale og uafhængige evalueringer.
Langtidsagentkørsler
De scores, K3 fører an i – SWE Marathon, Automation Bench, BrowseComp – er dem, der måler fastholdelse af opgaven over hundredvis af trin, snarere end enkeltstående korrekthed. Det stemmer overens med Moonshots opfattelse af modellen som en agentmotor først.
Fast 1M-token prissætning
Det fulde 1.048.576-token-vindue faktureres til én sats, uden tillæg ud over en tærskel. GPT-5.5's 1M-vindue prissætter derimod input over 272K tokens anderledes, hvilket er det, der gør meget lange enkeltkontekstkørsler dyre andre steder.
Omkostning pr. opgave
Artificial Analysis målte $0,94 pr. opgave på tværs af sit indeks – omtrent halvdelen af Claude Opus 4.8's $1,80 og på linje med GPT 5.6 Sol's $1,04. Moonshot nævner cache-hit-rater over 90% på kodningsarbejdsbelastninger, hvilket trækker den effektive inputpris mod den cachelagrede pris på $0,30.
Bedste agentopgaver for Kimi K3
Repository-skala læsning i én kontekst
Et 1M-token-vindue til en fast pris passer til en hel kodebase, et helt kvartal med supportbilletter eller et langt dokumentsæt i en enkelt anmodning uden opdeling og uden et langkontekst-tillæg, der venter i den fjerne ende af vinduet.
Browsing- og researchagenter
BrowseComp 91.2 er den højeste score i Moonshots lanceringsskema, foran GPT 5.6 Sol og Claude Fable 5.1. Multi-hop webforskning – find kilden, følg citatet, afstem tallene – er hvor K3's agenttræning viser sig tydeligst.
Skærmbillede og videoinput
K3 tager billeder og video nativt, så QA-agenter, der læser skærmbilleder og pipelines, der behandler optagede klip, behøver ikke en separat visionmodel indsat foran ræsonnementsmodellen.
Hvornår man skal springe Kimi K3 over
Spring K3 over, når arbejdet kræver en leverandørrevideret sikkerhedsprofil eller kontraktuel virksomhedssupport i USA eller EU; når prompts er korte nok til, at den $0.30 cache-hit rate aldrig lander, og en omkostningsbesparende model ville gøre det; og når selv-hosting er pointen — 594 GB MXFP4-vægte kræver 64 eller flere acceleratorer til en produktionsimplementering. Uafhængig test har også målt hallucinationsrater langt over Moonshots offentliggjorte tal, så faktatungt output skal stadig kontrolleres. Og på Okou specifikt er K3 slet ikke en mulighed.
Kimi K3 vs. andre modeller
Kimi K3 vs Claude Fable 5.1
Fable 5 fører Intelligence Index (59,9 til 57,1) og FrontierSWE (86,6 til 81,2); K3 tager Terminal-Bench 2.1, BrowseComp og SWE Marathon. Begge har et 1M-token vindue. Hvad der normalt afgør det, er pris og tilgængelighed: Fable 5 koster $10/$50 pr. million tokens og kører på Okou, K3 koster $3/$15 og gør det ikke.
Kimi K3 vs GPT 5.6 Sol
Sol scorer 58,9 på Intelligence Index mod K3's 57,1 og vinder DeepSWE (73,0 mod 67,5) og Terminal-Bench med et halvt point. K3 svarer med et 1M-vindue mod Sols 400K og en tredjedel af inputprisen. Den målte omkostning pr. opgave lander tæt: $0,94 for K3, $1,04 for Sol.
Kimi K3 vs Claude Opus 4.8
K3 er foran Opus 4.8 på de fleste agentiske suiter og på GDPval-AA Elo (1668 til 1600), til $3/$15 mod $5/$25. Opus 4.8 bevarer fordelen med hensyn til pålidelighed af værktøjsrouting i produktion og er tilgængelig på Okou, hvor K3 ikke er.
Kimi K3 vs Kimi K2.7 Code
K3 er efterfølgeren: 1M tokens kontekst mod 256K, native videoinput og et meget højere loft for agentiske benchmarks – til cirka tredobbelt pris ($3/$15 mod $1.14/$4.80). Ingen af dem kører på Okou i dag; K2.7 Code blev afnoteret, og K3 blev aldrig tilføjet.
Bundlinjen: skal du bruge Kimi K3?
Den stærkeste open-weight model, der er udgivet hidtil, og den første, der konkurrerer med den lukkede grænse for agentarbejde til en tredjedel af Fable 5's pris. Okou kører den ikke, så læs denne side som reference: for de samme 1M-token agent-arbejdsbelastninger på Okou er Claude Fable 5.1 det nærmeste match.
Ofte stillede spørgsmål
Kan jeg bruge Kimi K3 på Okou?
Ikke i dag. Kimi K3 er ikke en del af Okou-modeludvalget – den kan ikke vælges i chat eller i en arbejdsgang, og den kan ikke tilføjes med din egen API-nøgle. Claude Fable 5.1 er den nærmeste model Okou kører: det samme 1M-token kontekstvindue og den højeste score på det samme Intelligence Index.
Hvornår blev Kimi K3 udgivet?
Moonshot AI lancerede Kimi K3 den 16. juli 2026 i Kimi-appen og Kimi API, og offentliggjorde de åbne vægte på Hugging Face den 27. juli 2026.
Hvad er Kimi K3's kontekstvindue?
1.048.576 tokens, der dækker input og output samlet, prissat fast over hele vinduet. Output er som standard 131.072 tokens og kan konfigureres højere inden for den resterende kontekst.
Hvor meget koster Kimi K3?
$3,00 pr. million input-tokens ved et cache-miss, $0,30 pr. million ved et cache-hit og $15,00 pr. million output-tokens, uden tillæg for lang kontekst. I Kimi-appen starter betalte niveauer ved $19/måned for et 256K-vindue, og det fulde 1M-vindue låses op ved $39/måned.
Er Kimi K3 open source?
Vægtene er åbne under Moonshots egen Kimi K3-licens, som ligner MIT med to kommercielle betingelser: en model-as-a-service-virksomhed skal have en separat aftale med Moonshot, når omsætningen overstiger 20 mio. USD over 12 måneder, og ethvert produkt med over 100 millioner månedlige aktive brugere eller 20 mio. USD i månedlig omsætning skal vise "Kimi K3" i sin grænseflade.
Alternativer
Tilgængelighed af Kimi K3 på Okou
Kimi K3 er ikke en del af Okou-modeludvalget, så den kan ikke vælges i chat eller i en workflow, og den kan ikke tilføjes med din egen API-nøgle. Claude Fable 5.1 er den nærmeste model, Okou kører i dag.

