Kimi K3:Moonshot的2.8萬億參數前沿模型
Moonshot的2.8萬億參數混合專家模型,100萬token上下文視窗,原生支援影像和影片輸入,權重開放。
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou不執行Kimi K3。本頁只是它的規格、價格和基準測試參考。要在Okou上做同類工作,現在請用Claude Fable 5.1。
檢視Claude Fable 5.1Kimi K3是Moonshot AI於2026年7月16日發布的前沿模型:稀疏混合專家網路,總參數2.8萬億,每個token啟用896個專家中的16個,上下文視窗1,048,576個token,原生支援影像和影片輸入。Artificial Analysis在Intelligence Index v4.1上給它57.1分——在受測配置中排第四,落後於Claude Fable 5.1(59.9)和GPT 5.6 Sol(58.9),領先於Claude Opus 4.8。
標價是每百萬輸入token $3.00,快取命中時$0.30,每百萬輸出token $15.00;整個視窗統一價格,沒有長上下文附加費。開放權重於2026年7月27日在Hugging Face上線,採用Moonshot自家的Kimi K3 License。Okou不執行Kimi K3。Okou陣容裡最接近的是Claude Fable 5.1:同樣的100萬token視窗,並在同一份Intelligence Index上領跑。
Kimi K3是什麼?
2026年7月16日 · Moonshot的前沿產品線。Kimi K2系列(含K2.7 Code)的後繼者。
Kimi K3是Moonshot AI的前沿模型,2026年7月16日亮相,透過Kimi應用和Kimi API以kimi-k3提供服務。它是稀疏混合專家模型:總參數2.8萬億,每個token啟用896個專家中的16個——正是這一點,讓它在這麼大的參數量下,推理價格仍接近一箇中端稠密模型。
相比K2系列,提升最大的是長週期智能體任務。在Moonshot的發布測試集裡,K3在Program Bench、SWE Marathon、BrowseComp、SpreadsheetBench 2和Automation Bench上領先所有受測模型,只在FrontierSWE上落後於Claude Fable 5.1、在DeepSWE上落後於GPT 5.6 Sol。在衡量高經濟價值知識工作的Artificial Analysis GDPval-AA v2 Elo上,它拿到1668,高於Kimi K2.6的1190,也高於Claude Opus 4.8的1600。
Kimi K3有什麼特別之處
架構與能力上的主要亮點。
K3在MoE架構之外還配了兩項效率機制,Moonshot稱之為Kimi Delta Attention和Attention Residuals,據稱解碼速度最高可提升6.3倍;1,048,576個token的視窗按統一價格提供,不分上下文件位。輸出預設131,072個token,可在同一視窗內配置得更高。輸入支援文字、影像和影片,輸出為文字。platform.kimi.ai上的API相容OpenAI,權重(MXFP4格式約594 GB)也已公開,可自行部署。
規格速覽
Kimi K3基準測試
編碼、智能體和視覺分數來自Moonshot發布時的資料,所有模型都開到最高思考強度;Intelligence Index和GDPval Elo則是Artificial Analysis的獨立測試。廠商給出的表格是上限,不是保證;獨立測試方報告的幻覺率也明顯高於Moonshot自己公佈的數字。
Kimi K3價格
服務商標價,按每100萬token計。
Kimi K3實際用起來怎麼樣
廠商發布材料與獨立評測中公佈的表現。
長週期智能體執行
K3獨自領先的那幾項——SWE Marathon、Automation Bench、BrowseComp——衡量的是能不能在幾百步裡一直不跑偏,而不是一次答對。這也正好對上Moonshot把它首先定位成智能體引擎的說法。
100萬token統一定價
完整的1,048,576個token視窗只按一個價格計費,超過某個門檻也不加價。相比之下,GPT-5.5的100萬視窗對超過272K token的輸入另行定價——這正是在別處跑超長單上下文任務會變貴的原因。
單任務成本
Artificial Analysis在自己的指數測試中測得單任務成本$0.94,大約是Claude Opus 4.8($1.80)的一半,和GPT 5.6 Sol的$1.04接近。Moonshot稱編碼場景的快取命中率超過90%,這會把實際輸入成本拉向$0.30的快取價。
Kimi K3最適合的智能體任務
一個上下文讀完整個程式碼庫
100萬token視窗加統一價格,能把整個程式碼庫、一個季度的客服工單或一整套長文件裝進一次請求,不用切塊,視窗末端也沒有長上下文附加費等著。
瀏覽與研究型智能體
BrowseComp的91.2是Moonshot發布表裡的最高分,領先GPT 5.6 Sol和Claude Fable 5.1。多跳網路研究——找到出處、順著引用往下追、把數字對上——最能看出K3的智能體訓練。
截圖與影片輸入
K3原生接收影像和影片,所以讀截圖的QA智能體、處理錄屏片段的流水線,不用再在推理模型前面單獨接一個視覺模型。
什麼時候不該用Kimi K3
這幾種情況別用K3:工作需要廠商審計過的安全說明,或者美國、歐盟範圍內有合同保障的企業支援;提示詞短到根本吃不到$0.30的快取命中價,用一個省錢的模型就夠;以及自建部署本身就是目的——594 GB的MXFP4權重,生產部署要64張以上加速卡。獨立測試測到的幻覺率也明顯高於Moonshot公佈的數字,所以事實密集的輸出仍然需要核對。另外在Okou上,K3根本不是一個選項。
Kimi K3與其他模型對比
Kimi K3對比Claude Fable 5.1
Fable 5在Intelligence Index(59.9對57.1)和FrontierSWE(86.6對81.2)上領先;K3拿下Terminal-Bench 2.1、BrowseComp和SWE Marathon。兩者都是100萬token視窗。最後決定選誰的通常是價格和可用性:Fable 5每百萬token $10/$50,在Okou上能用;K3是$3/$15,但Okou上沒有。
Kimi K3對比GPT 5.6 Sol
Sol在Intelligence Index上是58.9,K3是57.1;Sol還贏下DeepSWE(73.0對67.5),Terminal-Bench上領先半分。K3的底牌是100萬視窗(Sol為400K)和三分之一的輸入價格。實測單任務成本接近:K3是$0.94,Sol是$1.04。
Kimi K3對比Claude Opus 4.8
在多數智能體測試集和GDPval-AA Elo(1668對1600)上,K3都領先Opus 4.8,價格是$3/$15對$5/$25。Opus 4.8在生產環境的工具排程可靠性上仍佔優,而且Okou上能用,K3不能。
Kimi K3對比Kimi K2.7 Code
K3是後繼者:100萬token上下文對256K,原生影片輸入,智能體基準的上限也高出一截——代價是價格大約三倍($3/$15對$1.14/$4.80)。兩者今天都不在Okou上:K2.7 Code已下架,K3從未上線。
結論:你該用Kimi K3嗎?
迄今發布的開放權重模型裡最強的一個,也是第一個在智能體任務上能和閉源前沿模型掰手腕、價格只有Fable 5三分之一的模型。Okou不執行它,所以這一頁當參考讀就好:同樣的100萬token智能體任務,在Okou上最接近的是Claude Fable 5.1。
常見問題
Okou上能用Kimi K3嗎?
目前不能。Kimi K3不在Okou的模型陣容裡——聊天和工作流裡都選不到,也不能用你自己的API金鑰接入。Okou執行的模型裡最接近的是Claude Fable 5.1:同樣的100萬token上下文視窗,以及同一份Intelligence Index上的最高分。
Kimi K3是什麼時候發布的?
Moonshot AI於2026年7月16日在Kimi應用和Kimi API上發布Kimi K3,並在2026年7月27日把開放權重發布到Hugging Face。
Kimi K3的上下文視窗有多大?
1,048,576個token,輸入和輸出合起來算,整個視窗統一價格。輸出預設131,072個token,可以在剩餘上下文範圍內配置得更高。
Kimi K3多少錢?
快取未命中時每百萬輸入token $3.00,快取命中時每百萬$0.30,每百萬輸出token $15.00,沒有長上下文附加費。在Kimi應用裡,付費檔從$19/月起,對應256K視窗;完整的100萬視窗在$39/月解鎖。
Kimi K3是開源的嗎?
權重按Moonshot自家的Kimi K3 License開放,條款讀起來像MIT加兩條商業限制:做模型即服務生意的公司,任意12個月內收入超過2,000萬美元就需要和Moonshot另行籤協議;月活超過1億或月收入超過2,000萬美元的產品,必須在介面上標出「Kimi K3」。
替代選擇
Kimi K3在Okou上的可用情況
Kimi K3不在Okou的模型陣容裡,因此無法在聊天或工作流中選用,也不能用你自己的API金鑰接入。Claude Fable 5.1是目前Okou執行的模型裡最接近的一個。

