Kimi K3: Moonshots 2.8T gränsmodell
Moonshots modell med 2,8 biljoner parametrar och Mixture-of-Experts, med ett kontextfönster på 1 miljon token, inbyggd bild- och videoingång samt öppna vikter.
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou kör inte Kimi K3. Denna sida är en referens för dess specifikationer, prissättning och benchmarks. För samma typ av arbete på Okou idag, använd Claude Fable 5.1.
Se Claude Fable 5.1Kimi K3 är Moonshot AI:s banbrytande modell, lanserad den 16 juli 2026: ett sparsamt Mixture-of-Experts-nätverk med 2,8 biljoner totala parametrar, 16 av 896 aktiva experter per token, ett kontextfönster på 1 048 576 tokens och inbyggd bild- och videoingång. Artificial Analysis bedömde den till 57,1 på Intelligence Index v4.1 – fjärde bland testade konfigurationer, efter Claude Fable 5.1 (59,9) och GPT 5.6 Sol (58,9), före Claude Opus 4.8.
Listpriset är 3,00 USD per miljon input-tokens, 0,30 USD vid en cacheträff och 15,00 USD per miljon output-tokens, fast över hela fönstret utan tillägg för lång kontext. Öppna vikter lades upp på Hugging Face den 27 juli 2026 under Moonshots egen Kimi K3-licens. Okou kör inte Kimi K3. Den närmaste modellen i Okou-sortimentet är Claude Fable 5.1, som matchar 1M-token-fönstret och leder samma Intelligence Index.
Vad är Kimi K3?
16 juli 2026 · Moonshots gränslinje. Efterföljare till Kimi K2-serien, inklusive K2.7 Code.
Kimi K3 är Moonshot AI:s banbrytande modell, presenterad den 16 juli 2026 och tillgänglig via Kimi-appen och Kimi API som kimi-k3. Det är en gles Mixture-of-Experts-modell: 2.8 biljoner totala parametrar med 16 av 896 experter aktiva per token, vilket är vad som håller inferenspriset nära en medelstor tät modell trots parameterantalet.
Hoppet över K2-linjen är störst på långsiktigt agentarbete. På Moonshots lanseringssvit leder K3 alla testade modeller på Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 och Automation Bench, samtidigt som den ligger efter Claude Fable 5.1 på FrontierSWE och GPT 5.6 Sol på DeepSWE. På Artificial Analysis GDPval-AA v2 Elo, som poängsätter ekonomiskt värdefullt kunskapsarbete, når den 1668, upp från Kimi K2.6:s 1190 och över Claude Opus 4.8:s 1600.
Vad är anmärkningsvärt med Kimi K3
Rubrikarkitektur och funktionsfunktioner.
K3 kombinerar MoE-stacken med två effektivitetsmekanismer som Moonshot kallar Kimi Delta Attention och Attention Residuals, som krediteras med upp till 6,3 gånger snabbare avkodning, och serverar sitt 1 048 576-tokenfönster till ett enda fast pris utan kontextnivåer. Utdata körs till 131 072 tokens som standard och kan konfigureras högre inom samma fönster. Indata omfattar text, bilder och video; utdata är text. API på platform.kimi.ai är OpenAI-kompatibel, och vikterna – ungefär 594 GB i MXFP4 – publiceras för egen hosting.
Specifikationer i korthet
Kimi K3 benchmarks
Kodnings-, agent- och visuella poäng är Moonshots lanseringssiffror, med varje modell på maximal tankeinsats; Intelligence Index och GDPval Elo är Artificial Analysis oberoende körningar. En leverantörstabell är ett tak snarare än en garanti, och oberoende testare har rapporterat en hallucinationsfrekvens långt över Moonshots egen siffra.
Kimi K3 prissättning
Leverantörens listpris, per 1M tokens.
Hur Kimi K3 beter sig i praktiken
Rapporterat beteende från leverantörens lanseringsmaterial och oberoende utvärderingar.
Långhorisontella agentkörningar
Poängen där K3 leder direkt – SWE Marathon, Automation Bench, BrowseComp – är de som mäter att hålla sig till uppgiften över hundratals steg, snarare än enstaka korrekthet. Det stämmer överens med Moonshots inramning av modellen som en agentmotor först.
Fast 1M-token prissättning
Det fulla 1 048 576-tokenfönstret faktureras till en enda taxa, utan tilläggsavgift över en viss tröskel. GPT-5.5:s 1M-fönster prissätter däremot inmatning över 272K tokens annorlunda, vilket gör mycket långa körningar med enstaka kontext dyra på andra ställen.
Kostnad per uppgift
Artificial Analysis mätte 0,94 USD per uppgift över sitt index – ungefär hälften av Claude Opus 4.8:s 1,80 USD och i linje med GPT 5.6 Sols 1,04 USD. Moonshot anger cache-träfffrekvenser över 90 % på kodningsarbetsbelastningar, vilket drar den effektiva ingångskostnaden mot den cachade hastigheten på 0,30 USD.
Bästa agentuppgifter för Kimi K3
Repository-skalig läsning i en kontext
Ett 1M-tokenfönster till ett fast pris rymmer en hel kodbas, ett helt kvartal med supportärenden eller en lång uppsättning dokument i en enda förfrågan utan att dela upp den, och utan en långkontextavgift som väntar i slutet av fönstret.
Webbläsning och forskningsagenter
BrowseComp 91.2 är den högsta poängen i Moonshots lanseringstabell, före GPT 5.6 Sol och Claude Fable 5.1. Flerstegs webbforskning – hitta källan, följ citatet, stäm av siffrorna – är där K3:s agentträning visar sig tydligast.
Skärmbild och videoinmatning
K3 tar bilder och video nativt, så QA-agenter som läser skärmdumpar och pipelines som bearbetar inspelade klipp behöver inte en separat visionsmodell inkopplad framför resonemangsmodellen.
När man ska hoppa över Kimi K3
Hoppa över K3 när arbetet kräver en leverantörsgranskad säkerhetsprofil eller avtalsenlig företagssupport i USA eller EU; när prompterna är tillräckligt korta för att den $0.30 cache-träfffrekvensen aldrig uppnås och en kostnadsbesparande modell skulle fungera; och när självhosting är poängen – 594 GB MXFP4-vikter kräver 64 eller fler acceleratorer för en produktionsdistribution. Oberoende tester har också mätt hallucinationsfrekvenser långt över Moonshots publicerade siffra, så faktabaserad utdata behöver fortfarande kontrolleras. Och på Okou specifikt är K3 inte alls ett alternativ.
Kimi K3 vs andra modeller
Kimi K3 vs Claude Fable 5.1
Fable 5 leder Intelligence Index (59,9 till 57,1) och FrontierSWE (86,6 till 81,2); K3 tar Terminal-Bench 2.1, BrowseComp och SWE Marathon. Båda har ett 1M-tokenfönster. Det som oftast avgör är pris och tillgänglighet: Fable 5 kostar 10$/50$ per miljon tokens och körs på Okou, K3 kostar 3$/15$ och gör det inte.
Kimi K3 vs GPT 5.6 Sol
Sol får 58,9 på Intelligence Index mot K3:s 57,1, och vinner DeepSWE (73,0 mot 67,5) och Terminal-Bench med en halv poäng. K3 svarar med ett 1M-fönster mot Sols 400K och en tredjedel av ingångspriset. Uppmätt kostnad per uppgift landar nära: 0,94 USD för K3, 1,04 USD för Sol.
Kimi K3 vs Claude Opus 4.8
K3 ligger före Opus 4.8 på de flesta agentiska sviter och på GDPval-AA Elo (1668 mot 1600), till $3/$15 mot $5/$25. Opus 4.8 behåller fördelen när det gäller tillförlitlighet för verktygsrouting i produktion och är tillgänglig på Okou, där K3 inte är det.
Kimi K3 vs Kimi K2.7 Code
K3 är efterföljaren: 1M tokens av kontext mot 256K, inbyggd videoingång och ett mycket högre tak för agentiska benchmarks – till ungefär tredubbla priset ($3/$15 mot $1.14/$4.80). Ingen av dem körs på Okou idag; K2.7 Code avlistades, och K3 lades aldrig till.
Slutsats: ska du använda Kimi K3?
Den starkaste open-weight-modellen som hittills släppts, och den första som konkurrerar med den stängda gränsen för agentarbete till en tredjedel av Fable 5:s pris. Okou kör den inte, så läs denna sida som referens: för samma 1M-token agentarbetsbelastningar på Okou är Claude Fable 5.1 den närmaste matchningen.
Vanliga frågor
Kan jag använda Kimi K3 på Okou?
Inte idag. Kimi K3 är inte en del av Okou:s modellutbud – den kan inte väljas i chatten eller i ett arbetsflöde, och den kan inte läggas till med din egen API-nyckel. Claude Fable 5.1 är den närmaste modellen Okou kör: samma 1M-token kontextfönster och högsta poäng på samma Intelligence Index.
När släpptes Kimi K3?
Moonshot AI lanserade Kimi K3 den 16 juli 2026 i Kimi-appen och Kimi API, och publicerade de öppna vikterna på Hugging Face den 27 juli 2026.
Vad är Kimi K3:s kontextfönster?
1 048 576 tokens, som täcker både inmatning och utmatning, prissatt fast över hela fönstret. Utmatningen är som standard 131 072 tokens och kan konfigureras högre inom den återstående kontexten.
Vad kostar Kimi K3?
3,00 USD per miljon inmatningstokens vid en cachemiss, 0,30 USD per miljon vid en cacheträff och 15,00 USD per miljon utmatningstokens, utan tillägg för lång kontext. I Kimi-appen börjar betalda nivåer på 19 USD/månad för ett 256K-fönster, och hela 1M-fönstret låses upp vid 39 USD/månad.
Är Kimi K3 öppen källkod?
Vikten är öppen under Moonshots egen Kimi K3-licens, som liknar MIT med två kommersiella villkor: ett modell-som-en-tjänst-företag behöver ett separat avtal med Moonshot när intäkterna överstiger 20 miljoner dollar under en 12-månadersperiod, och alla produkter över 100 miljoner månatliga aktiva användare eller 20 miljoner dollar i månatliga intäkter måste visa "Kimi K3" i sitt gränssnitt.
Alternativ
Tillgänglighet av Kimi K3 på Okou
Kimi K3 är inte en del av Okou-modellutbudet, så den kan inte väljas i chatt eller i ett arbetsflöde, och den kan inte läggas till med din egen API-nyckel. Claude Fable 5.1 är den närmaste modellen Okou kör idag.

