Wszystkie modele

Kimi K3: model graniczny 2.8T Moonshot

Model Moonshot z 2,8 biliona parametrów Mixture-of-Experts, z oknem kontekstowym 1M tokenów, natywnym wejściem obrazu i wideo oraz otwartymi wagami.

1M tokens · Text / Vision / Video / Code · Prompt cache

Okou nie uruchamia Kimi K3. Ta strona jest odniesieniem do jego specyfikacji, cen i benchmarków. Do tego samego rodzaju pracy na Okou dzisiaj użyj Claude Fable 5.1.

Zobacz Claude Fable 5.1

Kimi K3 to flagowy model Moonshot AI, wprowadzony na rynek 16 lipca 2026 r.: rzadka sieć Mixture-of-Experts z 2,8 biliona całkowitych parametrów, 16 z 896 aktywnych ekspertów na token, okno kontekstowe o rozmiarze 1 048 576 tokenów oraz natywne wejście obrazu i wideo. Artificial Analysis oceniło go na 57,1 w Intelligence Index v4.1 — czwarte miejsce wśród testowanych konfiguracji, za Claude Fable 5.1 (59,9) i GPT 5.6 Sol (58,9), przed Claude Opus 4.8.

Cena katalogowa wynosi 3,00 USD za milion tokenów wejściowych, 0,30 USD za trafienie w pamięci podręcznej i 15,00 USD za milion tokenów wyjściowych, stała w całym oknie bez dodatkowych opłat za długi kontekst. Otwarte wagi zostały udostępnione na Hugging Face 27 lipca 2026 r. na licencji Kimi K3 Moonshot. Okou nie obsługuje Kimi K3. Najbliższy model w ofercie Okou to Claude Fable 5.1, który odpowiada oknu 1 miliona tokenów i prowadzi w tym samym Intelligence Index.

Czym jest Kimi K3?

16 lipca 2026 · Linia graniczna Moonshot. Następca serii Kimi K2, w tym K2.7 Code.

Kimi K3 to model graniczny Moonshot AI, zaprezentowany 16 lipca 2026 roku i udostępniany za pośrednictwem aplikacji Kimi oraz API jako kimi-k3. Jest to rzadki model Mixture-of-Experts: 2,8 biliona całkowitych parametrów z 16 z 896 ekspertów aktywnych na token, co utrzymuje cenę wnioskowania blisko średniej klasy gęstego modelu pomimo liczby parametrów.

Skok powyżej linii K2 jest największy w przypadku długoterminowej pracy agentów. W pakiecie startowym Moonshot K3 przewyższa każdy testowany model na Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 i Automation Bench, ustępując jednocześnie Claude Fable 5.1 na FrontierSWE i GPT 5.6 Sol na DeepSWE. W rankingu GDPval-AA v2 Elo firmy Artificial Analysis, który ocenia ekonomicznie wartościową pracę umysłową, osiąga 1668 punktów, w porównaniu do 1190 punktów Kimi K2.6 i powyżej 1600 punktów Claude Opus 4.8.

Co jest godne uwagi w Kimi K3

Architektura nagłówków i funkcje możliwości.

K3 łączy stos MoE z dwoma mechanizmami wydajności, które Moonshot nazywa Kimi Delta Attention i Attention Residuals, przypisuje im do 6.3x szybsze dekodowanie i obsługuje okno 1 048 576 tokenów w jednej stałej cenie bez warstw kontekstowych. Domyślnie wyjście wynosi 131 072 tokeny i można je skonfigurować wyżej w tym samym oknie. Wejście obejmuje tekst, obrazy i wideo; wyjście to tekst. API w platform.kimi.ai jest kompatybilny z OpenAI, a wagi — około 594 GB w MXFP4 — są publikowane do samodzielnego hostowania.

Specyfikacje w skrócie

RodzinaKimi K3
ParametryŁącznie 2,8T / 16 z 896 aktywnych ekspertów (MoE)
ModalnościTekst, obraz, wideo wejście; tekst wyjście
Okno kontekstowe1 048 576 tokenów
Maksymalne wyjście131 tys. tokenów domyślnie, konfigurowalne w oknie
LicencjaLicencja Kimi K3 (otwarte wagi, 27 lipca 2026)

Benchmarki Kimi K3

Wyniki kodowania, agenta i wizualne to liczby startowe Moonshot, z każdym modelem pracującym z maksymalnym wysiłkiem myślowym; Intelligence Index i GDPval Elo to niezależne uruchomienia Artificial Analysis. Tabela dostawcy to raczej sufit niż gwarancja, a niezależni testerzy zgłaszali wskaźnik halucynacji znacznie wyższy niż własne dane Moonshot.

Indeks Sztucznej Inteligencji Analitycznej v4.1niezależny; #4 testowany, za Fable 5 (59.9) i GPT 5.6 Sol (58.9)
57.1
GDPval-AA v2 (Elo)niezależny; powyżej Opus 4.8 (1600)
1668
GPQA Diamondzgłoszone przez dostawcę
93.5
Terminal-Bench 2.1zgłoszone przez dostawcę; Sol 88.8
88.3
FrontierSWEzgłoszone przez dostawcę; Fable 5 86.6
81.2
DeepSWEzgłoszone przez dostawcę; Sol 73.0
67.5
SWE Marathonzgłoszone przez dostawcę; na szczycie pakietu startowego
42.0
BrowseCompzgłoszone przez dostawcę; na szczycie pakietu startowego
91.2

Cennik Kimi K3

Cena katalogowa dostawcy, za 1M tokenów.

Wejście$3.00
Wyjście$15.00
Odczyt pamięci podręcznej$0.30
Zapis pamięci podręcznejNie naliczono

Jak Kimi K3 zachowuje się w praktyce

Zgłoszone zachowanie z materiałów startowych dostawcy i niezależnych ocen.

Uruchomienia agentów o długim horyzoncie

Wyniki, w których K3 przoduje – SWE Marathon, Automation Bench, BrowseComp – to te, które mierzą utrzymanie się przy zadaniu przez setki kroków, a nie jednorazową poprawność. To pasuje do ram Moonshot, które traktują model jako przede wszystkim silnik agenta.

Płaska cena 1M tokenów

Pełne okno 1 048 576 tokenów jest rozliczane według jednej stawki, bez dopłat powyżej progu. Okno 1M GPT-5.5, w przeciwieństwie do tego, wycenia dane wejściowe powyżej 272K tokenów inaczej, co sprawia, że bardzo długie uruchomienia w jednym kontekście są drogie gdzie indziej.

Koszt zadania

Artificial Analysis zmierzyło 0,94 USD za zadanie w swoim indeksie — mniej więcej połowę 1,80 USD Claude Opus 4.8 i zgodnie z 1,04 USD GPT 5.6 Sol. Moonshot podaje wskaźniki trafień w pamięci podręcznej powyżej 90% w przypadku obciążeń kodowania, co obniża efektywny koszt wejściowy do 0,30 USD stawki buforowanej.

Najlepsze zadania agenta dla Kimi K3

Czytanie na skalę repozytorium w jednym kontekście

Okno 1M tokenów w stałej cenie mieści całą bazę kodu, cały kwartał zgłoszeń serwisowych lub długi zestaw dokumentów w jednym żądaniu bez dzielenia na fragmenty i bez dopłaty za długi kontekst czekającej na końcu okna.

Agenci przeglądania i badań

BrowseComp 91.2 to najwyższy wynik w tabeli startowej Moonshot, wyprzedzający GPT 5.6 Sol i Claude Fable 5.1. Wielokrokowe badania internetowe — znajdowanie źródła, śledzenie cytatów, uzgadnianie liczb — to obszar, w którym szkolenie agenta K3 jest najbardziej widoczne.

Wejście zrzutu ekranu i wideo

K3 natywnie obsługuje obrazy i wideo, więc agenci QA czytający zrzuty ekranu i potoki przetwarzające nagrane klipy nie potrzebują oddzielnego modelu wizyjnego wstawionego przed modelem rozumowania.

Kiedy pominąć Kimi K3

Pomiń K3, gdy praca wymaga audytowanego przez dostawcę profilu bezpieczeństwa lub umownego wsparcia korporacyjnego w USA lub UE; gdy prompt jest wystarczająco krótki, aby stawka 0.30 USD za trafienie w pamięci podręcznej nigdy nie została osiągnięta, a model oszczędzający koszty by wystarczył; i gdy samodzielne hostowanie jest celem — 594 GB wag MXFP4 wymaga 64 lub więcej akceleratorów do wdrożenia produkcyjnego. Niezależne testy zmierzyły również wskaźniki halucynacji znacznie powyżej opublikowanej przez Moonshot wartości, więc wyjście bogate w fakty nadal wymaga sprawdzenia. A konkretnie w Okou, K3 w ogóle nie jest opcją.

Kimi K3 vs inne modele

Kimi K3 vs Claude Fable 5.1

Fable 5 prowadzi w Intelligence Index (59,9 do 57,1) i FrontierSWE (86,6 do 81,2); K3 wygrywa w Terminal-Bench 2.1, BrowseComp i SWE Marathon. Oba mają okno 1M tokenów. Zazwyczaj decyduje o tym cena i dostępność: Fable 5 kosztuje 10$/50$ za milion tokenów i działa na Okou, K3 kosztuje 3$/15$ i nie działa.

Kimi K3 vs GPT 5.6 Sol

Sol zdobywa 58,9 punktu w Indeksie Inteligencji, w porównaniu do 57,1 punktu K3, i wygrywa DeepSWE (73,0 do 67,5) oraz Terminal-Bench o pół punktu. K3 odpowiada z oknem 1M w porównaniu do 400K Sol i jedną trzecią ceny wejściowej. Zmierzony koszt na zadanie jest zbliżony: 0,94 USD dla K3, 1,04 USD dla Sol.

Kimi K3 vs Claude Opus 4.8

K3 wyprzedza Opus 4.8 w większości pakietów agentowych i w GDPval-AA Elo (1668 do 1600), za 3$/15$ wobec 5$/25$. Opus 4.8 utrzymuje przewagę w niezawodności routingu narzędzi w produkcji i jest dostępny na Okou, gdzie K3 nie jest.

Kimi K3 vs Kimi K2.7 Code

K3 jest następcą: 1M tokenów kontekstu w porównaniu do 256K, natywne wejście wideo i znacznie wyższy pułap w testach agentowych — za około trzykrotnie wyższą cenę (3$/15$ w porównaniu do 1,14$/4,80$). Żaden z nich nie działa dziś na Okou; K2.7 Code został wycofany z listy, a K3 nigdy nie został dodany.

Podsumowując: czy powinieneś używać Kimi K3?

Najsilniejszy dotychczas wydany model o otwartym kodzie źródłowym i pierwszy, który konkuruje z zamkniętą granicą w pracy agenta za jedną trzecią ceny Fable 5. Okou go nie uruchamia, więc traktuj tę stronę jako odniesienie: dla tych samych obciążeń agenta 1M-tokenów na Okou, Claude Fable 5.1 jest najbliższym odpowiednikiem.

Często zadawane pytania

Czy mogę używać Kimi K3 na Okou?

Nie dzisiaj. Kimi K3 nie jest częścią linii modeli Okou — nie można go wybrać na czacie ani w przepływie pracy, ani dodać za pomocą własnego klucza API. Claude Fable 5.1 to najbliższy model, który uruchamia Okou: to samo okno kontekstowe 1M tokenów i najwyższy wynik w tym samym Indeksie Inteligencji.

Kiedy wydano Kimi K3?

Moonshot AI uruchomił Kimi K3 16 lipca 2026 r. w aplikacji Kimi i Kimi API, a otwarte wagi opublikował na Hugging Face 27 lipca 2026 r.

Jakie jest okno kontekstowe Kimi K3?

1 048 576 tokenów, obejmujących wejście i wyjście razem, wycenionych ryczałtowo w całym oknie. Domyślna liczba tokenów wyjściowych to 131 072 i można ją skonfigurować wyżej w ramach pozostałego kontekstu.

Ile kosztuje Kimi K3?

3,00 USD za milion tokenów wejściowych przy braku trafienia w pamięci podręcznej, 0,30 USD za milion przy trafieniu w pamięci podręcznej i 15,00 USD za milion tokenów wyjściowych, bez dodatkowej opłaty za długi kontekst. W aplikacji Kimi płatne poziomy zaczynają się od 19 USD/miesiąc za okno 256K, a pełne okno 1M odblokowuje się za 39 USD/miesiąc.

Czy Kimi K3 jest open source?

Wagi są otwarte na licencji Kimi K3 firmy Moonshot, która brzmi jak MIT z dwoma warunkami komercyjnymi: firma świadcząca usługi modelowe potrzebuje oddzielnej umowy z Moonshot, gdy przychody przekroczą 20 milionów dolarów w ciągu dowolnych 12 miesięcy, a każdy produkt z ponad 100 milionami aktywnych użytkowników miesięcznie lub 20 milionami dolarów miesięcznych przychodów musi wyświetlać „Kimi K3” w swoim interfejsie.

Alternatywy

Dostępność Kimi K3 na Okou

Kimi K3 nie jest częścią linii modeli Okou, więc nie można go wybrać w czacie ani w przepływie pracy, ani nie można go dodać za pomocą własnego klucza API. Claude Fable 5.1 to najbliższy model, który Okou uruchamia dzisiaj.