share_log

月之暗面全面開源Kimi K3!30分鐘登頂開源社區趨勢榜,國內外雲廠商集體宣佈Day0適配

財聯社 ·  07/28 11:27

①月之暗面發佈了模型權重、技術報告,以及支撐Kimi K3模型訓練的關鍵Infra技術;

②Kimi K3半小時登頂Hugging Face趨勢榜;

③機構稱,3T級別大模型推動行業部署架構轉向超節點集群,國產AI芯片迎來發展機遇。

月之暗面迄今能力最強的模型開源了。

7月27日晚上十一點,月之暗面發佈Kimi K3的模型權重、技術報告,並開源支撐Kimi K3模型訓練的關鍵Infra技術:MoonEP、FlashKDA和AgentEnv。這意味着,每個人都可以下載並部署Kimi K3模型——無論是用於內部研發,還是嵌入到面向終端用戶的產品中,均可自由使用

Kimi K3發佈於7月17日凌晨,是一個擁有2.8萬億參數的混合專家(MoE)模型,具備原生視覺理解能力,並支持100萬token的上下文窗口

同時,它也是全球首個開源的3萬億級別模型,面向長程編程、知識工作和推理等前沿智能場景而設計。

該模型開源後,Hugging Face CEO Clem Delangue發文,Kimi K3在30分鐘內以超過4000個贊登頂趨勢榜,「迄今爲止最快的發佈增長速度!!」

Kimi K3開源同日,多家AI生態鏈公司宣佈接入Kimi K3。

國內,華爲昇騰CANN宣佈,昇騰950全系列、AtlasA3產品支持Kimi K3部署,其表示,Kimi K3 896專家的大EP部署場景,能夠充分發揮昇騰超節點架構優勢。同時,趨境科技基於開源推理引擎SGLang完成了Kimi K3在昇騰AtlasA3上的Day0推理適配。

另據阿里雲消息,阿里雲真武M890超節點實例已Day0適配Kimi K3,雙方將進一步展開國產算力合作,千問AI平台和阿里雲百鍊也將提供Kimi K3的模型API。

國外,NEBIUS、Baseten、Fireworks等AI基礎設施廠商也宣佈Day0適配Kimi K3。NEBIUS稱:「Kimi K3是首個達到前沿性能水平的開放權重模型,是開放模型發展歷程中的一大進步。」

知名AI編程公司Cursor稱已經引入Kimi K3;數字員工Devin開發主體Cognition宣佈,Kimi K3現已接入Devin桌面客戶端與命令行工具(CLI),並稱:「在Frontier Code1.1評測基準上,Kimi K3是我們測試過首款性能逼近前沿水準的開源模型。」

模型權重、47頁技術報告、關鍵Infra技術齊公開

與Kimi K3模型權重一起公開的,還有其技術報告和模型訓練方法。

據介紹,從技術報告中可以了解這些技術細節:

KDA+AttnRes:以3:1比例混合KDA與GatedMLA,實現高效長上下文建模,並通過塊級注意力殘差增強跨層信息流動。

Stable LatentMoE:每個token從896個路由專家中激活16個,並通過SiTU-GLU與Quantile Balancing保持極高稀疏度下的訓練穩定。

MoonViT-V2:視覺編碼器從零開始使用next-tokenp rediction訓練,無需對比預訓練,在達到SigLIP初始化基線效果的同時獲得更穩定的優化過程。

後訓練與評估:在通用推理、通用Agent和編程Agent三大領域進行大規模任務合成,百萬token上下文的強化學習基建,近20個內部評測集的完整評估結果。

模型能力背後,離不開訓練系統,即Infra基礎設施層的穩定支撐。月之暗面詳細介紹了支撐Kimi K3訓練的三項Infra技術:MoonEP、FlashKDA和AgentEnv,覆蓋從高性能通信、高性能算子到分佈式RL環境的關鍵鏈路,是支撐Kimi K3訓練效率與穩定性的關鍵。其中FlashKDA此前已開源,MoonEP和AgentEnv則隨本次發佈正式開源。

MoonEP:MoonEP是月之暗面爲超大的細粒度MoE打造的高性能通信庫,讓專家並行(expert-parallel)的通信在不均衡的情況下仍然實現極致效率。

FlashKDA:FlashKDA是月之暗面實現的KimiDelta Attention高性能算子(kernel)。在英偉達H20上,相比flash-linear-attention基線,它的prefill速度提升1.72-2.22倍,可以直接作爲flash-linear-attention的替換後端。

AgentEnv:AgentENV是月之暗面與KVCache.ai合作開發的沙箱系統,用於大規模運行Agent環境。它爲Kimi K3的後訓練提供高保真、強隔離沙箱,靈活支持快速快照、恢復和分叉(fork)等,可以應對大規模並行的Agent工作流與訓練任務。

開源模型進入3T時代 將持續拉動雲、算力基礎設施需求

黃仁勳於7月24日在社交平台X發佈其第一條推文,內容是一封由a16z發起、英偉達聯合Perplexity AI、Ollama等多家科技公司共同簽署的公開信。公開信明確主張"前沿開源模型與前沿閉源模型應並存發展",稱開源模型具備安全、創新、AI自主主權多重價值,行業將同步發展前沿閉源與開源模型,持續拉動雲、算力基礎設施需求。即便基座開源,大模型廠商仍具備底層調優優勢,配套開源組件同步加速行業滲透。

國金證券表示,國產開源模型持續實現技術突破,Kimi K3作爲全球首個開放3T級模型拉開開源大模型3T時代序幕,3T級別大模型推動行業部署架構轉向超節點集群,國產AI芯片迎來發展機遇。具體來看,Kimi K3官方要求至少64卡集群才能實現高效推理,2026WAIC展會中華爲昇騰、沐曦等國產芯片廠商集中推出大規格超節點產品;3T模型將競爭從單卡性能延伸至芯片、高速互聯、整機集群、推理軟件棧一體化系統能力,具備完整超節點產品與生態適配能力的國產芯片廠商充分受益。

國盛證券表示,開源模型能力大幅躍遷,將抬高全行業「底線水位」,看好下半年下游應用滲透&Token消耗加速。該機構稱,當開源前沿快速逼近閉源SOTA,全行業可獲取的「最低能力水位」被顯著抬高,下游應用開發者能以更低成本用上近前沿能力。落到配置,看好:

(1)最受益的是有真實場景、數據壁壘和工程化能力的應用/Agent鏈;

(2)模型端優選具備自有生態與商業化閉環(雲等)的平台型廠商如阿里、騰訊、智譜、Minimax;

(3)開源放量拉動訓練/推理需求,國產算力鏈同步受益。

編輯/melody

譯文內容由第三人軟體翻譯。


以上內容僅用作資訊或教育之目的,不構成與象象銀行相關的任何投資建議。象象銀行竭力但無法保證上述全部內容的真實性、準確性和原創性。