Kimi K3正式开源:全球首个3万亿参数级超级模型,性能跻身世界前三
引言
2026年7月27日,月之暗面(Moonshot AI)正式将Kimi K3的完整模型权重上传至Hugging Face,同步发布了完整技术报告,并开源了支撑训练的关键基础设施技术。这是全球首个进入3万亿参数级别的开放权重模型——总参数2.8万亿、激活1040亿、支持100万token上下文窗口。距离7月16日K3以托管服务首发,整整11天。
模型核心规格
Kimi K3是月之暗面目前能力最强的模型,采用混合专家(MoE)架构。在896个专家中,每次推理仅激活16个,实现了极高的效率。模型原生支持视觉理解,能够处理图像和视频输入,主要面向长程编程、复杂智能体、知识工作和深度推理任务。
尽管参数量约为前代Kimi K2.5的3倍,但通过Kimi Delta Attention、Attention Residuals及MoonEP等技术创新,单位算力下的智能产出效率提升约2.5倍。这意味着K3在提供更强能力的同时,并未带来等比例的资源消耗增长。
技术架构创新
Kimi K3的技术架构包含多项自主创新:
- KDA混合线性注意力机制(Kimi Delta Attention):让信息在更长序列和更深模型中流动得更顺畅。
- 注意力残差(Attention Residuals):通过低于2%的额外成本实现约25%的训练效率提升,并达到最高6.3倍解码加速。
- MoonEP:自研的高性能通信库,优化了大规模分布式训练的通信效率。
- FlashKDA:高性能注意力算子,加速模型推理过程。
- AgentEnv:分布式Agent沙箱系统,支持多智能体协同工作。
性能表现
根据Artificial Analysis等第三方评测机构的报告,Kimi K3在多项基准测试中表现出色:
- 综合智能水平接近Claude Fable 5和GPT-5.6 Sol等闭源旗舰模型。
- 在Arena AI前端开发榜单上直接登顶,展现了卓越的编程能力。
- 在复杂的多步骤工作中,其性能与GPT-5.5和Claude Opus 4.8相当。
- 在GPU内核优化测试中接近Fable 5,适合处理长时编程和多模态任务。
月之暗面官方也展现了客观务实的态度:虽然Kimi K3在综合表现上与目前海外极少数最顶级的闭源巨无霸模型相比仍有一定提升空间,但作为开源模型,它表现稳定,在多个代码及数学推理基准中取得了具有竞争力的表现。
开源内容与许可证
本次开源的内容包括:
- 完整的模型权重
- 详细的技术报告
- MoonEP高性能通信库
- FlashKDA注意力算子
- AgentEnv分布式Agent沙箱系统
模型采用名为"Kimi K3 License"的定制许可证。月之暗面表示,开源旨在降低获取智能的门槛,推动创新,并赋予用户对数据更大的控制权、隐私保护和所有权。
部署建议
由于模型规模达到2.8万亿参数,官方建议使用配备64张或更多加速卡的Supernode进行推理部署。这意味着即使完整权重开放,Kimi K3的私有化部署也将主要面向云计算平台、研究机构和大型企业。
在GPU开发案例中,Kimi K3从零构建了MiniTriton编程系统,覆盖DSL前端、MLIR中间表示、优化流程、PTX代码生成和运行时组件。在另一项测试中,Kimi K3连续自主运行48小时,使用开源EDA工具完成一款小型芯片的设计、优化和验证。
行业影响
Kimi K3的发布对行业具有多重意义:
首先,它打破了"前沿AI必须依赖前沿算力支出"的叙事——一个开源模型在多个基准上达到或超越闭源旗舰,证明算法效率和架构创新可以弥补算力差距。
其次,K3在Arena.ai前端开发排行榜上登顶,表明国产模型在编程和Agent等实用场景中已具备国际竞争力。
第三,2.8万亿参数的开源权重承诺,将为全球AI研究者提供迄今规模最大的开放基座,可能加速整个开源生态的技术迭代。
据OpenRouter数据显示,中国开源模型目前已占该多模型API网关路由token用量的46.4%,美国模型为35.7%。这一数据反映了中国开源模型在全球AI生态中的影响力正在快速提升。
结语
Kimi K3的开源标志着中国AI产业在开源领域迈出了重要一步。作为全球首个3万亿参数级别的开放权重模型,K3不仅展现了月之暗面的技术实力,也为全球AI开发者提供了宝贵的资源。随着开源权重的发布,我们期待看到更多基于K3的创新应用和研究涌现。
对于开发者而言,如果需要处理百万词元上下文和视觉任务,可以优先测试Kimi K3 API;对于企业用户,若重视长期可控性,应关注权重开放后的本地部署方案,同时对比Fable 5的闭源限制。
