Kimi K3:Moonshot的2.8万亿参数前沿模型
Moonshot的2.8万亿参数混合专家模型,100万token上下文窗口,原生支持图像和视频输入,权重开放。
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou不运行Kimi K3。本页只是它的规格、价格和基准测试参考。要在Okou上做同类工作,现在请用Claude Fable 5.1。
查看Claude Fable 5.1Kimi K3是Moonshot AI于2026年7月16日发布的前沿模型:稀疏混合专家网络,总参数2.8万亿,每个token激活896个专家中的16个,上下文窗口1,048,576个token,原生支持图像和视频输入。Artificial Analysis在Intelligence Index v4.1上给它57.1分——在受测配置中排第四,落后于Claude Fable 5.1(59.9)和GPT 5.6 Sol(58.9),领先于Claude Opus 4.8。
标价是每百万输入token $3.00,缓存命中时$0.30,每百万输出token $15.00;整个窗口统一价格,没有长上下文附加费。开放权重于2026年7月27日在Hugging Face上线,采用Moonshot自家的Kimi K3 License。Okou不运行Kimi K3。Okou阵容里最接近的是Claude Fable 5.1:同样的100万token窗口,并在同一份Intelligence Index上领跑。
Kimi K3是什么?
2026年7月16日 · Moonshot的前沿产品线。Kimi K2系列(含K2.7 Code)的后继者。
Kimi K3是Moonshot AI的前沿模型,2026年7月16日亮相,通过Kimi应用和Kimi API以kimi-k3提供服务。它是稀疏混合专家模型:总参数2.8万亿,每个token激活896个专家中的16个——正是这一点,让它在这么大的参数量下,推理价格仍接近一个中端稠密模型。
相比K2系列,提升最大的是长周期智能体任务。在Moonshot的发布测试集里,K3在Program Bench、SWE Marathon、BrowseComp、SpreadsheetBench 2和Automation Bench上领先所有受测模型,只在FrontierSWE上落后于Claude Fable 5.1、在DeepSWE上落后于GPT 5.6 Sol。在衡量高经济价值知识工作的Artificial Analysis GDPval-AA v2 Elo上,它拿到1668,高于Kimi K2.6的1190,也高于Claude Opus 4.8的1600。
Kimi K3有什么特别之处
架构与能力上的主要亮点。
K3在MoE架构之外还配了两项效率机制,Moonshot称之为Kimi Delta Attention和Attention Residuals,据称解码速度最高可提升6.3倍;1,048,576个token的窗口按统一价格提供,不分上下文档位。输出默认131,072个token,可在同一窗口内配置得更高。输入支持文本、图像和视频,输出为文本。platform.kimi.ai上的API兼容OpenAI,权重(MXFP4格式约594 GB)也已公开,可自行部署。
规格速览
Kimi K3基准测试
编码、智能体和视觉分数来自Moonshot发布时的数据,所有模型都开到最高思考强度;Intelligence Index和GDPval Elo则是Artificial Analysis的独立测试。厂商给出的表格是上限,不是保证;独立测试方报告的幻觉率也明显高于Moonshot自己公布的数字。
Kimi K3价格
服务商标价,按每100万token计。
Kimi K3实际用起来怎么样
厂商发布材料与独立评测中公布的表现。
长周期智能体运行
K3独自领先的那几项——SWE Marathon、Automation Bench、BrowseComp——衡量的是能不能在几百步里一直不跑偏,而不是一次答对。这也正好对上Moonshot把它首先定位成智能体引擎的说法。
100万token统一定价
完整的1,048,576个token窗口只按一个价格计费,超过某个门槛也不加价。相比之下,GPT-5.5的100万窗口对超过272K token的输入另行定价——这正是在别处跑超长单上下文任务会变贵的原因。
单任务成本
Artificial Analysis在自己的指数测试中测得单任务成本$0.94,大约是Claude Opus 4.8($1.80)的一半,和GPT 5.6 Sol的$1.04接近。Moonshot称编码场景的缓存命中率超过90%,这会把实际输入成本拉向$0.30的缓存价。
Kimi K3最适合的智能体任务
一个上下文读完整个代码库
100万token窗口加统一价格,能把整个代码库、一个季度的客服工单或一整套长文档装进一次请求,不用切块,窗口末端也没有长上下文附加费等着。
浏览与研究型智能体
BrowseComp的91.2是Moonshot发布表里的最高分,领先GPT 5.6 Sol和Claude Fable 5.1。多跳网络研究——找到出处、顺着引用往下追、把数字对上——最能看出K3的智能体训练。
截图与视频输入
K3原生接收图像和视频,所以读截图的QA智能体、处理录屏片段的流水线,不用再在推理模型前面单独接一个视觉模型。
什么时候不该用Kimi K3
这几种情况别用K3:工作需要厂商审计过的安全说明,或者美国、欧盟范围内有合同保障的企业支持;提示词短到根本吃不到$0.30的缓存命中价,用一个省钱的模型就够;以及自建部署本身就是目的——594 GB的MXFP4权重,生产部署要64张以上加速卡。独立测试测到的幻觉率也明显高于Moonshot公布的数字,所以事实密集的输出仍然需要核对。另外在Okou上,K3根本不是一个选项。
Kimi K3与其他模型对比
Kimi K3对比Claude Fable 5.1
Fable 5在Intelligence Index(59.9对57.1)和FrontierSWE(86.6对81.2)上领先;K3拿下Terminal-Bench 2.1、BrowseComp和SWE Marathon。两者都是100万token窗口。最后决定选谁的通常是价格和可用性:Fable 5每百万token $10/$50,在Okou上能用;K3是$3/$15,但Okou上没有。
Kimi K3对比GPT 5.6 Sol
Sol在Intelligence Index上是58.9,K3是57.1;Sol还赢下DeepSWE(73.0对67.5),Terminal-Bench上领先半分。K3的底牌是100万窗口(Sol为400K)和三分之一的输入价格。实测单任务成本接近:K3是$0.94,Sol是$1.04。
Kimi K3对比Claude Opus 4.8
在多数智能体测试集和GDPval-AA Elo(1668对1600)上,K3都领先Opus 4.8,价格是$3/$15对$5/$25。Opus 4.8在生产环境的工具调度可靠性上仍占优,而且Okou上能用,K3不能。
Kimi K3对比Kimi K2.7 Code
K3是后继者:100万token上下文对256K,原生视频输入,智能体基准的上限也高出一截——代价是价格大约三倍($3/$15对$1.14/$4.80)。两者今天都不在Okou上:K2.7 Code已下架,K3从未上线。
结论:你该用Kimi K3吗?
迄今发布的开放权重模型里最强的一个,也是第一个在智能体任务上能和闭源前沿模型掰手腕、价格只有Fable 5三分之一的模型。Okou不运行它,所以这一页当参考读就好:同样的100万token智能体任务,在Okou上最接近的是Claude Fable 5.1。
常见问题
Okou上能用Kimi K3吗?
目前不能。Kimi K3不在Okou的模型阵容里——聊天和工作流里都选不到,也不能用你自己的API密钥接入。Okou运行的模型里最接近的是Claude Fable 5.1:同样的100万token上下文窗口,以及同一份Intelligence Index上的最高分。
Kimi K3是什么时候发布的?
Moonshot AI于2026年7月16日在Kimi应用和Kimi API上发布Kimi K3,并在2026年7月27日把开放权重发布到Hugging Face。
Kimi K3的上下文窗口有多大?
1,048,576个token,输入和输出合起来算,整个窗口统一价格。输出默认131,072个token,可以在剩余上下文范围内配置得更高。
Kimi K3多少钱?
缓存未命中时每百万输入token $3.00,缓存命中时每百万$0.30,每百万输出token $15.00,没有长上下文附加费。在Kimi应用里,付费档从$19/月起,对应256K窗口;完整的100万窗口在$39/月解锁。
Kimi K3是开源的吗?
权重按Moonshot自家的Kimi K3 License开放,条款读起来像MIT加两条商业限制:做模型即服务生意的公司,任意12个月内收入超过2,000万美元就需要和Moonshot另行签协议;月活超过1亿或月收入超过2,000万美元的产品,必须在界面上标出「Kimi K3」。
替代选择
Kimi K3在Okou上的可用情况
Kimi K3不在Okou的模型阵容里,因此无法在聊天或工作流中选用,也不能用你自己的API密钥接入。Claude Fable 5.1是目前Okou运行的模型里最接近的一个。

