中國大模型企業月之暗面宣佈全面開源,K3背後的技術細節也隨之浮出水面。
7月27日,月之暗面(Kimi)宣佈發佈Kimi K3的模型權重、技術報告,並開源支撐Kimi K3模型訓練的關鍵Infra技術:MoonEP、Flash KDA和Agent Env,希望以此加速前沿智能的部署與普及,促進AGI研究。
Kimi介紹,在並不寬裕的算力條件下,K3憑藉Kimi Delta Attention、Attention Residuals以及MoonEP等一系列技術創新,實現模型規模化效率提升2.5倍,即在算力最優意義下,單位算力產出智能約等於原來的2.5倍。
此前7月16日,Kimi推出2.8萬億參數的Kimi K3,成為全球參數最大的開源模型,瞬間震動全球——發佈48小時後,用戶請求量逼近集群承載極限。7月19日晚,月之暗面發佈公告,暫停C端新用戶訂閱,將全部算力優先保障已付費老用戶。
目前,K3已經實現全面開源。據介紹,每個人都可以下載並部署Kimi K3模型,無論是用於內部研發,還是嵌入面向終端用戶的產品中,均可自由使用。“我們相信,對於AGI這樣具有深遠影響的技術,一個廣泛、開放的生態系統是最適合承載它的土壤。為此,我們將繼續貢獻自己的力量。”Kimi表示。
海外媒體和開發者盛讚K3
對於K3此次開源,外媒分析,這是對AI大廠的有力挑戰,尤其是Anthropic和OpenAI。這兩家公司最新的模型分別是Claude Fable和GPT系列模型,K3性能緊隨其後,其運行成本似乎只有它們的1/2-1/3;如果特定查詢被緩存,成本甚至可以降低至十分之一。
另有外媒報導稱,美國公司正在迅速採用Kimi模型,目前中國人工智能模型已占OpenRouter等平臺上整體使用量的60%。與閉源模型相比,Kimi K3還展現出卓越的成本效益,每投入一美元可以完成更多任務。外媒稱,人工智慧的基礎設施特性決定其必須採用開源才能產生廣泛的經濟影響,因為閉源會阻礙應用和定制,最終開源會更受青睞。
Hugging Face首席執行官Clement Delangue表示,K3發佈後很快登上Hugging Face趨勢榜首,社區反響非常強烈。
北美AI基礎設施創企Osmantic AI的創始人兼CEO Ahmad發文,將Kimi K3稱為“本地版Fable 5”,並稱“知道為什麼Anthropic討厭開源AI嗎?Kimi K3免費且可下載,讓他們的萬億美元估值失去意義。”
7月28日,據Design Arena在社交媒體發文,Kimi K3在“Python-PPTX Slides”幻燈片競技場以Elo評分1379分登頂,領先第二名Claude Fable 5(1303分)76分。帖文將Kimi K3稱為“無限制級模型”,並稱其以該榜單所見“最大優勢”獲得第一名。

月之暗面Kimi創始人楊植麟。
Kimi創始人楊植麟曾多次公開表達對開源的態度。
“當前閉源模型仍佔據一部分市場份額,而開源正在持續解鎖更多的市場空間。最終如果模型能力達到同等水準,開源會是絕對的勝利者。”此前在接受澎湃新聞等媒體採訪時,楊植麟表示,開源的核心競爭力在於其構建了生態共贏的合作模式,所有參與者都能在技術迭代與產業落地的過程中獲得收益,進而催生海量的應用場景與管道,形成完整、自迴圈的產業生態。
“開源生態的市場總量,最終會達到遠超閉源模式的水準,這也是中國AI產業當下最重要的發展思路與機遇。”楊植麟提到。
2026年7月20日,上海,2026世界人工智慧大會上,月之暗面旗下新一代模型Kimi K3發佈。
K3技術亮點在哪里
澎湃新聞記者梳理Kimi K3公佈的技術報告顯示,此次K3全面開源有三大核心亮點:
第一,這是全球首個開源“3T級”模型。
報告顯示,Kimi K3總參數2.8萬億(2.8T),每次回答實際啟動1040億參數,支持100萬token上下文窗口,原生支持圖片和視頻理解。這是全球第一個開放全部權重的3T級模型,此前開源模型大多停留在1萬億參數級別。
從綜合性能來看,K3只輸兩個最強閉源模型(Claude Fable 5、GPT-5.6 Sol),但穩定超過Claude Opus 4.8、GPT-5.5等其他所有參評模型。這也意味著,繼DeepSeek之後,中國公司再次用“開源”衝擊全球AI前沿水準。
第二,K3體現AI“自我進化”能力。
報告中提到,K3在一次無人干預的48小時連續運行中,用開源EDA工具設計並驗證一款AI推理晶片原型(nano-KPU):4平方毫米面積內集成146萬個標準單元,仿真推理速度超每秒8700個token。
此外,K3從零開發名為MiniTriton的編譯器,從編程語言前端到英偉達顯卡底層代碼生成全鏈條貫通,在其基準測試中幾何平均性能超過PyTorch官方兩種模式。報告還披露,K3的一個早期版本在開發後期已經承擔公司內部大部分GPU內核優化工作。
第三,超高性價比。
根據BrowseComp(網頁流覽智能體測試)顯示,K3拿到全場最高分91.2%,而每個任務成本僅2.03美元,這是GPT-5.6 Sol的一半,比Claude系列便宜約一個數量級。
在編程測試Kimi Code Bench 2.0中,Kimi得分只比Claude Fable 5低4分,成本只有對方的38%。而根據知識工作測試GDPval-AAv2,Kimi與GPT-5.6 Sol差距在50個Elo分以內,成本低13%。
在結構創新方面,報告披露,K3採取KDA+AttnRes結構替代傳統注意力結構(如Transformer)。在此次更新中,K3自研的Kimi Delta Attention(KDA)起到關鍵作用:KDA能實現“速記式”線性注意力,不管上下文多長,記憶成本不變;剩下1層用Gated MLA做“全文精讀”,保證關鍵處不丟精度。
重新定義“開源”和“商業”
除了技術層面,此次Kimi發佈的K3許可證也受到業內廣泛關注,其中有兩個關鍵要素:
一,經營模型即服務(Model as a Service)業務,且自身及關聯方年營收超過2000萬美元的公司,需要另行簽訂商業協議。
二,如果任何商業產品或服務的月活躍用戶超過1億,或者月收入超過2000萬美元,則需要在介面顯著位置展示”Kimi K3″標識。
這也意味著,“開源”不等同於“免費”,Kimi正在嘗試定義開源開放和商業回報之間的衡量方式。
在Kimi宣佈開源後,國內雲計算大廠在第一時間回應並適配。
華為計算發文表示,此次Kimi K3一經開源發佈,昇騰即實現0day(指在產品正式發佈或系統上線當天“第0天”就能完全相容和正常運行的能力)適配:在訓練側,基於MindSpeed MM在Atlas 800 A3、Atlas 900 A3 SuperPoD上完成訓練複現,在算子、並行加速、顯存優化等方面進行專項優化;在推理側,通過vLLM Ascend與SGLang開源推理引擎實現快速部署。同時,昇騰950超節點支持FP8、MXFP8、MXFP4等全系列數值精度格式,原生支持Kimi K3的mxFP4量化權重。

2026年7月17日,上海,在2026世界人工智慧大會上,阿裏巴巴展示旗下平頭哥研發的新一代訓推一體AI晶片“真武M890”。
阿裏雲宣佈,真武M890超節點實例已Day0適配Kimi K3,這是國內首個成功運行近3萬億參數模型的超節點。該超節點通過ICN Switch高速互聯晶片,將64張平頭哥真武M890晶片以800GB/s全互聯,顯存規模達9TB,單實例即可支撐大規模萬億級MoE模型的專家並行需求。
為提升運行效率,阿裏雲、平頭哥與Kimi團隊從軟體棧、算子層面進行了深度聯合適配,優化後首Token時延降低約35%,單卡解碼吞吐提升1.8倍,可穩定支持1M長上下文。千問AI平臺和阿裏雲百煉將同步提供Kimi K3的模型API。阿裏雲表示,該適配驗證了國產算力已具備支撐超大參數模型大規模應用的能力。
來源:中國澎湃新聞