Kimi K3: Mô hình tiên phong 2.8T của Moonshot
Mô hình Mixture-of-Experts 2,8 nghìn tỷ tham số của Moonshot, với cửa sổ ngữ cảnh 1M token, đầu vào hình ảnh và video gốc và trọng số mở.
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou không chạy Kimi K3. Trang này là tài liệu tham khảo về thông số kỹ thuật, giá cả và điểm chuẩn của nó. Đối với cùng loại công việc trên Okou ngày nay, hãy sử dụng Claude Fable 5.1.
Xem Claude Fable 5.1Kimi K3 là mô hình tiên phong của Moonshot AI, ra mắt vào ngày 16 tháng 7 năm 2026: một mạng lưới Mixture-of-Experts thưa thớt với tổng cộng 2,8 nghìn tỷ tham số, 16 trong số 896 chuyên gia hoạt động trên mỗi token, cửa sổ ngữ cảnh 1.048.576 token và đầu vào hình ảnh và video tự nhiên. Artificial Analysis đã chấm điểm 57,1 trên Chỉ số Thông minh v4.1 — đứng thứ tư trong số các cấu hình được thử nghiệm, sau Claude Fable 5.1 (59,9) và GPT 5.6 Sol (58,9), trước Claude Opus 4.8.
Giá niêm yết là 3,00 đô la cho mỗi triệu token đầu vào, 0,30 đô la khi truy cập bộ nhớ cache và 15,00 đô la cho mỗi triệu token đầu ra, cố định trên toàn bộ cửa sổ mà không có phụ phí ngữ cảnh dài. Trọng số mở đã được đăng trên Hugging Face vào ngày 27 tháng 7 năm 2026 theo Giấy phép Kimi K3 của Moonshot. Okou không chạy Kimi K3. Mô hình gần nhất trong dòng sản phẩm Okou là Claude Fable 5.1, khớp với cửa sổ 1 triệu token và dẫn đầu cùng Chỉ số Thông minh.
Kimi K3 là gì?
Ngày 16 tháng 7 năm 2026 · Dòng sản phẩm tiên phong của Moonshot. Kế nhiệm dòng Kimi K2, bao gồm K2.7 Code.
Kimi K3 là mô hình tiên phong của Moonshot AI, được công bố vào ngày 16 tháng 7 năm 2026 và được phục vụ thông qua ứng dụng Kimi và Kimi API dưới dạng kimi-k3. Đây là một mô hình Mixture-of-Experts thưa thớt: tổng cộng 2,8 nghìn tỷ tham số với 16 trong số 896 chuyên gia hoạt động trên mỗi token, điều này giúp giữ giá suy luận gần với một mô hình dày đặc cấp trung mặc dù số lượng tham số lớn.
Bước nhảy vọt qua dòng K2 là lớn nhất trong công việc tác nhân dài hạn. Trên bộ khởi chạy của Moonshot, K3 dẫn đầu mọi mô hình được thử nghiệm trên Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 và Automation Bench, trong khi tụt hậu so với Claude Fable 5.1 trên FrontierSWE và GPT 5.6 Sol trên DeepSWE. Trên GDPval-AA v2 Elo của Artificial Analysis, đánh giá công việc tri thức có giá trị kinh tế, nó đạt 1668, tăng từ 1190 của Kimi K2.6 và trên 1600 của Claude Opus 4.8.
Điều gì đáng chú ý về Kimi K3
Kiến trúc tiêu đề và các tính năng khả năng.
K3 kết hợp ngăn xếp MoE với hai cơ chế hiệu quả mà Moonshot gọi là Kimi Delta Attention và Attention Residuals, được ghi nhận là giải mã nhanh hơn tới 6,3 lần và cung cấp cửa sổ 1.048.576 token với một mức giá cố định duy nhất mà không cần phân cấp ngữ cảnh. Đầu ra chạy tới 131.072 token theo mặc định và có thể được cấu hình cao hơn trong cùng một cửa sổ. Đầu vào bao gồm văn bản, hình ảnh và video; đầu ra là văn bản. API tại platform.kimi.ai tương thích với OpenAI và các trọng số — khoảng 594 GB trong MXFP4 — được xuất bản để tự lưu trữ.
Thông số kỹ thuật nhanh
Điểm chuẩn Kimi K3
Điểm mã hóa, tác nhân và hình ảnh là các con số ra mắt của Moonshot, với mỗi mô hình ở mức nỗ lực suy nghĩ tối đa; Chỉ số Thông minh và GDPval Elo là các lần chạy độc lập của Artificial Analysis. Bảng nhà cung cấp là một giới hạn chứ không phải là một sự đảm bảo, và các nhà kiểm tra độc lập đã báo cáo tỷ lệ ảo giác cao hơn nhiều so với con số của Moonshot.
Giá Kimi K3
Giá niêm yết của nhà cung cấp, trên 1 triệu token.
Cách Kimi K3 hoạt động trong thực tế
Hành vi được báo cáo từ tài liệu ra mắt của nhà cung cấp và các đánh giá độc lập.
Chạy tác nhân tầm xa
Các điểm số mà K3 dẫn đầu hoàn toàn — SWE Marathon, Automation Bench, BrowseComp — là những điểm số đo lường việc duy trì nhiệm vụ qua hàng trăm bước, thay vì độ chính xác một lần. Điều đó phù hợp với cách Moonshot định hình mô hình như một công cụ tác nhân trước tiên.
Giá 1M token cố định
Cửa sổ 1.048.576 token đầy đủ được tính phí theo một mức, không có phụ phí vượt quá ngưỡng. Ngược lại, cửa sổ 1M của GPT-5.5 định giá đầu vào trên 272K token khác nhau, đó là điều khiến các lần chạy ngữ cảnh đơn rất dài trở nên đắt đỏ ở những nơi khác.
Chi phí mỗi tác vụ
Artificial Analysis đo được 0,94 đô la cho mỗi tác vụ trên chỉ số của nó — khoảng một nửa so với 1,80 đô la của Claude Opus 4.8 và phù hợp với 1,04 đô la của GPT 5.6 Sol. Moonshot trích dẫn tỷ lệ truy cập bộ nhớ cache trên 90% đối với khối lượng công việc mã hóa, điều này kéo chi phí đầu vào hiệu quả về mức giá 0,30 đô la được lưu trong bộ nhớ cache.
Các tác vụ tác nhân tốt nhất cho Kimi K3
Đọc quy mô kho lưu trữ trong một ngữ cảnh
Một cửa sổ 1 triệu token với giá cố định phù hợp với toàn bộ cơ sở mã, một quý đầy đủ các yêu cầu hỗ trợ hoặc một bộ tài liệu dài vào một yêu cầu duy nhất mà không cần phân đoạn, và không có phụ phí ngữ cảnh dài chờ ở cuối cửa sổ.
Các tác nhân duyệt và nghiên cứu
BrowseComp 91.2 là điểm số cao nhất trong bảng ra mắt của Moonshot, vượt qua GPT 5.6 Sol và Claude Fable 5.1. Nghiên cứu web đa bước — tìm nguồn, theo dõi trích dẫn, đối chiếu các con số — là nơi đào tạo tác nhân của K3 thể hiện rõ ràng nhất.
Đầu vào ảnh chụp màn hình và video
K3 xử lý hình ảnh và video nguyên bản, vì vậy các tác nhân QA đọc ảnh chụp màn hình và các quy trình xử lý clip đã ghi không cần một mô hình thị giác riêng biệt được ghép nối trước mô hình lý luận.
Khi nào nên bỏ qua Kimi K3
Bỏ qua K3 khi công việc cần hồ sơ an toàn được nhà cung cấp kiểm toán hoặc hỗ trợ doanh nghiệp theo hợp đồng ở Hoa Kỳ hoặc EU; khi lời nhắc đủ ngắn để tỷ lệ truy cập bộ nhớ cache 0,30 đô la không bao giờ đạt được và một mô hình tiết kiệm chi phí sẽ hoạt động; và khi tự lưu trữ là mục tiêu — 594 GB trọng số MXFP4 cần 64 hoặc nhiều bộ tăng tốc hơn cho một triển khai sản xuất. Thử nghiệm độc lập cũng đã đo lường tỷ lệ ảo giác cao hơn nhiều so với con số được Moonshot công bố, vì vậy đầu ra nặng về dữ kiện vẫn cần kiểm tra. Và cụ thể trên Okou, K3 hoàn toàn không phải là một lựa chọn.
Kimi K3 so với các mô hình khác
Kimi K3 so với Claude Fable 5.1
Fable 5 dẫn đầu Chỉ số Thông minh (59,9 so với 57,1) và FrontierSWE (86,6 so với 81,2); K3 dẫn đầu Terminal-Bench 2.1, BrowseComp và SWE Marathon. Cả hai đều có cửa sổ 1M token. Điều thường quyết định là giá cả và tính khả dụng: Fable 5 có giá 10$/50$ cho mỗi triệu token và chạy trên Okou, K3 có giá 3$/15$ và không chạy.
Kimi K3 so với GPT 5.6 Sol
Sol đạt 58,9 điểm trên Chỉ số Thông minh so với 57,1 của K3, và thắng DeepSWE (73,0 so với 67,5) và Terminal-Bench với nửa điểm. K3 trả lời với cửa sổ 1M so với 400K của Sol và một phần ba giá đầu vào. Chi phí đo được cho mỗi tác vụ gần nhau: 0,94 đô la cho K3, 1,04 đô la cho Sol.
Kimi K3 so với Claude Opus 4.8
K3 vượt trội hơn Opus 4.8 trên hầu hết các bộ tác nhân và trên GDPval-AA Elo (1668 so với 1600), với giá 3$/15$ so với 5$/25$. Opus 4.8 vẫn giữ ưu thế về độ tin cậy định tuyến công cụ trong sản xuất và có sẵn trên Okou, nơi K3 không có.
Kimi K3 so với Mã Kimi K2.7
K3 là phiên bản kế nhiệm: 1 triệu token ngữ cảnh so với 256K, đầu vào video gốc và trần cao hơn nhiều đối với các điểm chuẩn tác nhân — với giá cao gấp ba lần (3$/15$ so với 1,14$/4,80$). Cả hai đều không chạy trên Okou hiện nay; K2.7 Code đã bị loại bỏ, và K3 chưa bao giờ được thêm vào.
Điểm mấu chốt: bạn có nên sử dụng Kimi K3 không?
Mô hình mã nguồn mở mạnh nhất được phát hành cho đến nay, và là mô hình đầu tiên cạnh tranh với biên giới đóng trên công việc tác nhân với giá bằng một phần ba của Fable 5. Okou không chạy nó, vì vậy hãy đọc trang này như một tài liệu tham khảo: đối với cùng khối lượng công việc tác nhân 1M mã thông báo trên Okou, Claude Fable 5.1 là sự kết hợp gần nhất.
Các câu hỏi thường gặp
Tôi có thể sử dụng Kimi K3 trên Okou không?
Không phải hôm nay. Kimi K3 không phải là một phần của dòng mô hình Okou — nó không thể được chọn trong trò chuyện hoặc trong quy trình làm việc, và nó không thể được thêm bằng khóa API của riêng bạn. Claude Fable 5.1 là mô hình gần nhất mà Okou chạy: cùng cửa sổ ngữ cảnh 1M mã thông báo và điểm số cao nhất trên cùng Chỉ số Thông minh.
Kimi K3 được phát hành khi nào?
Moonshot AI đã ra mắt Kimi K3 vào ngày 16 tháng 7 năm 2026 trong ứng dụng Kimi và Kimi API, và xuất bản các trọng số mở trên Hugging Face vào ngày 27 tháng 7 năm 2026.
Cửa sổ ngữ cảnh của Kimi K3 là gì?
1.048.576 token, bao gồm cả đầu vào và đầu ra, được tính giá cố định trên toàn bộ cửa sổ. Đầu ra mặc định là 131.072 token và có thể được cấu hình cao hơn trong ngữ cảnh còn lại.
Kimi K3 có giá bao nhiêu?
3,00 đô la cho mỗi triệu token đầu vào khi bộ nhớ cache bị lỗi, 0,30 đô la cho mỗi triệu khi bộ nhớ cache trúng và 15,00 đô la cho mỗi triệu token đầu ra, không có phụ phí ngữ cảnh dài. Trong ứng dụng Kimi, các cấp trả phí bắt đầu từ 19 đô la/tháng cho cửa sổ 256K, và cửa sổ 1M đầy đủ được mở khóa với giá 39 đô la/tháng.
Kimi K3 có mã nguồn mở không?
Các trọng số được mở theo Giấy phép Kimi K3 của Moonshot, có nội dung giống như MIT với hai điều kiện thương mại: một doanh nghiệp mô hình dưới dạng dịch vụ cần một thỏa thuận riêng với Moonshot khi doanh thu vượt quá 20 triệu đô la trong bất kỳ 12 tháng nào, và bất kỳ sản phẩm nào có hơn 100 triệu người dùng hoạt động hàng tháng hoặc 20 triệu đô la doanh thu hàng tháng phải hiển thị "Kimi K3" trong giao diện của nó.
Các lựa chọn thay thế
Khả dụng của Kimi K3 trên Okou
Kimi K3 không phải là một phần của dòng mô hình Okou, vì vậy nó không thể được chọn trong trò chuyện hoặc trong một quy trình làm việc, và nó không thể được thêm bằng khóa API của riêng bạn. Claude Fable 5.1 là mô hình gần nhất mà Okou đang chạy hiện nay.

