发生了什么
7月16日深夜,月之暗面在2026世界人工智能大会(WAIC)开幕前夕正式发布Kimi K3模型。该模型总参数规模达到2.8万亿,采用混合专家(MoE)架构,激活参数通过更稀疏的路由策略实现高效推理。公司官方博客称K3为「迄今能力最强的Kimi模型」。
关键技术特征
- KDA混合线性注意力机制(Kimi Delta Attention),替代传统自注意力以支持超长上下文的高效处理
- 注意力残差(Attention Residuals)技术,增强深层网络的训练稳定性
- 原生多模态视觉理解,可直接处理图像输入
- 100万token上下文窗口,适合长文档分析、长程编程和复杂推理任务
- 更稀疏的MoE路由策略,在保持2.8万亿总参数的同时控制推理成本
为什么重要
K3的出现对行业有三重意义。其一,它打破了「前沿AI必须依赖前沿算力支出」的叙事——一个开源模型在多个基准上达到或超越闭源旗舰,证明算法效率和架构创新可以弥补算力差距。其二,K3在Arena.ai前端开发排行榜上登顶,表明国产模型在编程和Agent等实用场景中已具备国际竞争力。其三,2.8万亿参数的开源权重承诺(7月27日放出),将为全球AI研究者提供迄今规模最大的开放基座,可能加速整个开源生态的技术迭代。
市场影响
K3发布消息次日,多家美国科技媒体以「中国抹去了美国在AI领域的领先地位」为题进行报道。Axios、The Verge等均将此视为中美AI竞争格局的重要转折点。与此同时,K3的高性能与开源策略引发了对芯片股估值的重新评估——如果开源模型能在消费级硬件上运行,那么对高端算力的需求预期可能需要修正。目前K3 API已通过Kimi开放平台提供,开源权重预计7月27日正式放出。

