share_log

月之暗面全面开源Kimi K3!30分钟登顶开源社区趋势榜,国内外云厂商集体宣布Day0适配

cls.cn ·  28 ก.ค. 11:27

①月之暗面发布了模型权重、技术报告,以及支撑Kimi K3模型训练的关键Infra技术;

②Kimi K3半小时登顶Hugging Face趋势榜;

③机构称,3T级别大模型推动行业部署架构转向超节点集群,国产AI芯片迎来发展机遇。

月之暗面迄今能力最强的模型开源了。

7月27日晚上十一点,月之暗面发布Kimi K3的模型权重、技术报告,并开源支撑Kimi K3模型训练的关键Infra技术:MoonEP、FlashKDA和AgentEnv。这意味着,每个人都可以下载并部署Kimi K3模型——无论是用于内部研发,还是嵌入到面向终端用户的产品中,均可自由使用

Kimi K3发布于7月17日凌晨,是一个拥有2.8万亿参数的混合专家(MoE)模型,具备原生视觉理解能力,并支持100万token的上下文窗口

同时,它也是全球首个开源的3万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

该模型开源后,Hugging Face CEO Clem Delangue发文,Kimi K3在30分钟内以超过4000个赞登顶趋势榜,“迄今为止最快的发布增长速度!!”

Kimi K3开源同日,多家AI生态链公司宣布接入Kimi K3。

国内,华为昇腾CANN宣布,昇腾950全系列、AtlasA3产品支持Kimi K3部署,其表示,Kimi K3 896专家的大EP部署场景,能够充分发挥昇腾超节点架构优势。同时,趋境科技基于开源推理引擎SGLang完成了Kimi K3在昇腾AtlasA3上的Day0推理适配。

另据阿里云消息,阿里云真武M890超节点实例已Day0适配Kimi K3,双方将进一步展开国产算力合作,千问AI平台和阿里云百炼也将提供Kimi K3的模型API。

国外,Nebius、Baseten、Fireworks等AI基础设施厂商也宣布Day0适配Kimi K3。Nebius称:“Kimi K3是首个达到前沿性能水平的开放权重模型,是开放模型发展历程中的一大进步。”

知名AI编程公司Cursor称已经引入Kimi K3;数字员工Devin开发主体Cognition宣布,Kimi K3现已接入Devin桌面客户端与命令行工具(CLI),并称:“在Frontier Code1.1评测基准上,Kimi K3是我们测试过首款性能逼近前沿水准的开源模型。”

模型权重、47页技术报告、关键Infra技术齐公开

与Kimi K3模型权重一起公开的,还有其技术报告和模型训练方法。

据介绍,从技术报告中可以了解这些技术细节:

KDA+AttnRes:以3:1比例混合KDA与GatedMLA,实现高效长上下文建模,并通过块级注意力残差增强跨层信息流动。

Stable LatentMoE:每个token从896个路由专家中激活16个,并通过SiTU-GLU与Quantile Balancing保持极高稀疏度下的训练稳定。

MoonViT-V2:视觉编码器从零开始使用next-tokenp rediction训练,无需对比预训练,在达到SigLIP初始化基线效果的同时获得更稳定的优化过程。

后训练与评估:在通用推理、通用Agent和编程Agent三大领域进行大规模任务合成,百万token上下文的强化学习基建,近20个内部评测集的完整评估结果。

模型能力背后,离不开训练系统,即Infra基础设施层的稳定支撑。月之暗面详细介绍了支撑Kimi K3训练的三项Infra技术:MoonEP、FlashKDA和AgentEnv,覆盖从高性能通信、高性能算子到分布式RL环境的关键链路,是支撑Kimi K3训练效率与稳定性的关键。其中FlashKDA此前已开源,MoonEP和AgentEnv则随本次发布正式开源。

MoonEP:MoonEP是月之暗面为超大的细粒度MoE打造的高性能通信库,让专家并行(expert-parallel)的通信在不均衡的情况下仍然实现极致效率。

FlashKDA:FlashKDA是月之暗面实现的KimiDelta Attention高性能算子(kernel)。在英伟达H20上,相比flash-linear-attention基线,它的prefill速度提升1.72-2.22倍,可以直接作为flash-linear-attention的替换后端。

AgentEnv:AgentENV是月之暗面与KVCache.ai合作开发的沙箱系统,用于大规模运行Agent环境。它为Kimi K3的后训练提供高保真、强隔离沙箱,灵活支持快速快照、恢复和分叉(fork)等,可以应对大规模并行的Agent工作流与训练任务。

开源模型进入3T时代 将持续拉动云、算力基础设施需求

黄仁勋于7月24日在社交平台X发布其第一条推文,内容是一封由a16z发起、英伟达联合Perplexity AI、Ollama等多家科技公司共同签署的公开信。公开信明确主张"前沿开源模型与前沿闭源模型应并存发展",称开源模型具备安全、创新、AI自主主权多重价值,行业将同步发展前沿闭源与开源模型,持续拉动云、算力基础设施需求。即便基座开源,大模型厂商仍具备底层调优优势,配套开源组件同步加速行业渗透。

国金证券表示,国产开源模型持续实现技术突破,Kimi K3作为全球首个开放3T级模型拉开开源大模型3T时代序幕,3T级别大模型推动行业部署架构转向超节点集群,国产AI芯片迎来发展机遇。具体来看,Kimi K3官方要求至少64卡集群才能实现高效推理,2026WAIC展会中华为昇腾、沐曦等国产芯片厂商集中推出大规格超节点产品;3T模型将竞争从单卡性能延伸至芯片、高速互联、整机集群、推理软件栈一体化系统能力,具备完整超节点产品与生态适配能力的国产芯片厂商充分受益。

国盛证券表示,开源模型能力大幅跃迁,将抬高全行业“底线水位”,看好下半年下游应用渗透&Token消耗加速。该机构称,当开源前沿快速逼近闭源SOTA,全行业可获取的“最低能力水位”被显著抬高,下游应用开发者能以更低成本用上近前沿能力。落到配置,看好:

(1)最受益的是有真实场景、数据壁垒和工程化能力的应用/Agent链;

(2)模型端优选具备自有生态与商业化闭环(云等)的平台型厂商如阿里、腾讯、智谱、Minimax;

(3)开源放量拉动训练/推理需求,国产算力链同步受益。

编辑/melody

The above content is for informational or educational purposes only and does not constitute any investment advice related to EleBank. Although we strive to ensure the truthfulness, accuracy, and originality of all such content, we cannot guarantee it.