Kimi K3: Moonshotův hraniční model 2.8T
Model Moonshot s 2,8 biliony parametrů Mixture-of-Experts, s kontextovým oknem 1M tokenů, nativním vstupem obrazu a videa a otevřenými váhami.
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou nespouští Kimi K3. Tato stránka je referencí pro jeho specifikace, ceny a benchmarky. Pro stejný druh práce na Okou dnes použijte Claude Fable 5.1.
Viz Claude Fable 5.1Kimi K3 je hraniční model Moonshot AI, spuštěný 16. července 2026: řídká síť Mixture-of-Experts s celkem 2,8 biliony parametrů, 16 z 896 aktivních expertů na token, kontextové okno 1 048 576 tokenů a nativní vstup obrazu a videa. Artificial Analysis mu udělila 57,1 bodu v Intelligence Index v4.1 – čtvrté místo mezi testovanými konfiguracemi, za Claude Fable 5.1 (59,9) a GPT 5.6 Sol (58,9), před Claude Opus 4.8.
Ceníková cena je 3,00 $ za milion vstupních tokenů, 0,30 $ za zásah do cache a 15,00 $ za milion výstupních tokenů, paušálně po celém okně bez příplatku za dlouhý kontext. Otevřené váhy byly zveřejněny na Hugging Face 27. července 2026 pod vlastní licencí Moonshot Kimi K3. Okou nespouští Kimi K3. Nejbližší model v řadě Okou je Claude Fable 5.1, který odpovídá oknu 1M tokenů a vede stejný Intelligence Index.
Co je Kimi K3?
16. července 2026 · Hraniční linie Moonshotu. Nástupce řady Kimi K2, včetně K2.7 Code.
Kimi K3 je hraniční model Moonshot AI, představený 16. července 2026 a poskytovaný prostřednictvím aplikace Kimi a API Kimi jako kimi-k3. Jedná se o řídký model Mixture-of-Experts: celkem 2,8 bilionu parametrů s 16 z 896 aktivních expertů na token, což udržuje cenu inference blízko středněúrovňového hustého modelu navzdory počtu parametrů.
Největší skok přes linii K2 je u dlouhodobé práce agentů. V sadě Moonshot K3 vede každý testovaný model na Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 a Automation Bench, zatímco zaostává za Claude Fable 5.1 na FrontierSWE a GPT 5.6 Sol na DeepSWE. Na GDPval-AA v2 Elo od Artificial Analysis, které hodnotí ekonomicky cennou znalostní práci, dosahuje 1668, což je nárůst z 1190 u Kimi K2.6 a nad 1600 u Claude Opus 4.8.
Co je pozoruhodné na Kimi K3
Architektura nadpisů a funkce schopností.
K3 kombinuje MoE stack se dvěma mechanismy efektivity, které Moonshot nazývá Kimi Delta Attention a Attention Residuals, jimž se připisuje až 6,3x rychlejší dekódování, a nabízí své okno o velikosti 1 048 576 tokenů za jedinou pevnou cenu bez vrstvení kontextu. Výstup standardně dosahuje 131 072 tokenů a lze jej konfigurovat výše v rámci stejného okna. Vstup pokrývá text, obrázky a video; výstup je text. API na platform.kimi.ai je kompatibilní s OpenAI a váhy – zhruba 594 GB v MXFP4 – jsou publikovány pro vlastní hostování.
Specifikace na první pohled
Benchmarky Kimi K3
Skóre pro kódování, agenty a vizuální skóre jsou spouštěcí čísla Moonshot, přičemž každý model pracuje s maximálním úsilím; Intelligence Index a GDPval Elo jsou nezávislé běhy Artificial Analysis. Tabulka dodavatele je spíše strop než záruka a nezávislí testeři hlásili míru halucinací výrazně nad vlastními údaji Moonshot.
Ceny Kimi K3
Cena poskytovatele, za 1M tokenů.
Jak se Kimi K3 chová v praxi
Nahlášené chování z propagačních materiálů dodavatele a nezávislých hodnocení.
Spuštění agenta s dlouhým horizontem
Skóre, ve kterých K3 vede – SWE Marathon, Automation Bench, BrowseComp – jsou ta, která měří udržení úkolu napříč stovkami kroků, spíše než jednorázovou správnost. To odpovídá pojetí modelu Moonshot jako primárně agentního enginu.
Paušální cena 1M tokenů
Celé okno s 1 048 576 tokeny se účtuje jednou sazbou, bez příplatku nad určitou hranici. Okno 1M GPT-5.5 naopak oceňuje vstup nad 272K tokenů odlišně, což činí velmi dlouhé běhy s jedním kontextem jinde drahými.
Náklady na úkol
Artificial Analysis naměřila 0,94 $ za úkol napříč svým indexem – zhruba polovinu 1,80 $ u Claude Opus 4.8 a v souladu s 1,04 $ u GPT 5.6 Sol. Moonshot uvádí míru zásahů do mezipaměti nad 90 % u kódovacích úloh, což tlačí efektivní vstupní náklady k 0,30 $ za uloženou rychlost.
Nejlepší úkoly agenta pro Kimi K3
Čtení v rozsahu úložiště v jednom kontextu
Okno 1M tokenů za pevnou cenu pojme celou kódovou základnu, celý kvartál lístků podpory nebo dlouhou sadu dokumentů do jediného požadavku bez rozdělování a bez příplatku za dlouhý kontext čekajícího na konci okna.
Agenti pro procházení a výzkum
BrowseComp 91.2 je nejvyšší skóre v tabulce spuštění Moonshot, před GPT 5.6 Sol a Claude Fable 5.1. Vícekrokové webové vyhledávání – najít zdroj, sledovat citaci, sladit čísla – je to, kde se nejjasněji projevuje trénink agenta K3.
Vstup snímku obrazovky a videa
K3 nativně přijímá obrázky a video, takže agenti QA čtoucí snímky obrazovky a pipeline zpracovávající nahrané klipy nepotřebují samostatný vizuální model vložený před model uvažování.
Kdy přeskočit Kimi K3
Přeskočte K3, když práce vyžaduje dodavatelem auditovaný bezpečnostní profil nebo smluvní podnikovou podporu v USA nebo EU; když jsou výzvy dostatečně krátké, aby se sazba za zásah do mezipaměti 0,30 $ nikdy neprojevila a stačil by model šetřící náklady; a když je cílem vlastní hostování – 594 GB vah MXFP4 vyžaduje 64 nebo více akcelerátorů pro produkční nasazení. Nezávislé testování také naměřilo míru halucinací výrazně nad publikovanou hodnotou Moonshotu, takže výstup bohatý na fakta stále vyžaduje kontrolu. A konkrétně na Okou není K3 vůbec možností.
Kimi K3 vs. jiné modely
Kimi K3 vs Claude Fable 5.1
Fable 5 vede v Intelligence Index (59,9 ku 57,1) a FrontierSWE (86,6 ku 81,2); K3 vede v Terminal-Bench 2.1, BrowseComp a SWE Marathon. Oba mají okno 1M tokenů. Obvykle rozhoduje cena a dostupnost: Fable 5 stojí 10 $/50 $ za milion tokenů a běží na Okou, K3 stojí 3 $/15 $ a ne.
Kimi K3 vs GPT 5.6 Sol
Sol dosahuje 58,9 bodů v Intelligence Indexu oproti 57,1 bodům K3 a vyhrává DeepSWE (73,0 ku 67,5) a Terminal-Bench o půl bodu. K3 odpovídá s oknem 1M oproti 400K Solu a třetinou vstupní ceny. Měřené náklady na úkol jsou si blízké: 0,94 $ pro K3, 1,04 $ pro Sol.
Kimi K3 vs Claude Opus 4.8
K3 je před Opus 4.8 ve většině agentních sad a na GDPval-AA Elo (1668 ku 1600), za 3 $/15 $ proti 5 $/25 $. Opus 4.8 si udržuje náskok v spolehlivosti směrování nástrojů v produkci a je k dispozici na Okou, kde K3 není.
Kimi K3 vs Kimi K2.7 Code
K3 je nástupce: 1M tokenů kontextu oproti 256K, nativní video vstup a mnohem vyšší strop na agentních benchmarcích – za zhruba trojnásobnou cenu (3 $/15 $ oproti 1,14 $/4,80 $). Ani jeden dnes neběží na Okou; K2.7 Code byl vyřazen a K3 nikdy nebyl přidán.
Sečteno a podtrženo: měli byste používat Kimi K3?
Nejsilnější dosud vydaný model s otevřenou váhou a první, který konkuruje uzavřené hranici v práci agentů za třetinu ceny Fable 5. Okou jej nespouští, takže si tuto stránku přečtěte jako referenci: pro stejné pracovní zátěže agentů s 1M tokeny na Okou je Claude Fable 5.1 nejbližší shoda.
Často kladené otázky
Mohu použít Kimi K3 na Okou?
Dnes ne. Kimi K3 není součástí modelové řady Okou – nelze ji vybrat v chatu ani v pracovním postupu a nelze ji přidat pomocí vlastního klíče API. Claude Fable 5.1 je nejbližší model, který Okou provozuje: stejné kontextové okno 1M tokenů a nejvyšší skóre na stejném indexu inteligence.
Kdy byl vydán Kimi K3?
Moonshot AI spustil Kimi K3 16. července 2026 v aplikaci Kimi a Kimi API a 27. července 2026 zveřejnil otevřené váhy na Hugging Face.
Jaké je kontextové okno Kimi K3?
1 048 576 tokenů, zahrnujících vstup i výstup dohromady, s jednotnou cenou v celém okně. Výstup je standardně 131 072 tokenů a lze jej konfigurovat výše v rámci zbývajícího kontextu.
Kolik stojí Kimi K3?
3,00 $ za milion vstupních tokenů při chybě mezipaměti, 0,30 $ za milion při zásahu mezipaměti a 15,00 $ za milion výstupních tokenů, bez příplatku za dlouhý kontext. V aplikaci Kimi začínají placené úrovně na 19 $/měsíc za okno 256K a plné okno 1M se odemkne za 39 $/měsíc.
Je Kimi K3 open source?
Váhy jsou otevřené pod vlastní licencí Kimi K3 od Moonshot, která se čte jako MIT se dvěma komerčními podmínkami: podnikání s modelem jako službou potřebuje samostatnou smlouvu s Moonshot, jakmile příjmy přesáhnou 20 milionů dolarů za jakýchkoli 12 měsíců, a jakýkoli produkt s více než 100 miliony aktivních uživatelů měsíčně nebo 20 miliony dolarů měsíčních příjmů musí ve svém rozhraní zobrazovat „Kimi K3“.
Alternativy
Dostupnost Kimi K3 na Okou
Kimi K3 není součástí modelové řady Okou, takže jej nelze vybrat v chatu ani v pracovním postupu a nelze jej přidat pomocí vlastního klíče API. Claude Fable 5.1 je nejbližší model, který Okou dnes provozuje.

