刚刚,Kimi K3全面开源!3万亿模型权重面向全球开放(附开源地址)

作者:袖梨 2026-07-29

就在刚刚,Kimi K3作为全球首个3万亿参数级开源模型正式开放!

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

https://huggingface.co/moonshotai/Kimi-K3

https://github.com/MoonshotAI/Kimi-K3/tree/main

https://modelscope.cn/organization/moonshotai

Moonshot AI宣布,发布Kimi K3的模型权重、技术报告,并开源支撑Kimi K3模型训练的关键Infra技术:MoonEP、FlashKDA和AgentEnv。

面对目前最强的闭源模型Fable 5和GPT-5.6 Sol,全球首个能在复杂推理、超长上下文智能体协作及长逻辑链编程领域与之抗衡的开源模型已经出现:原生多模态MoE巨兽K3,参数量高达2.8T!

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

这项里程碑工作不只体现了中国AI团队雄厚的研发实力,也把真正意义上的前沿级智能带给了开源社区。

K3权重开放,3万亿参数级开源AI时代由此开启

2026年7月27日,Moonshot AI履行承诺,正式向全球开源社区发布Kimi K3完整模型权重。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

全球首个真正实现落地的3万亿参数级别开源模型由此诞生,Kimi K3推动开源大模型正式跨入2.8万亿参数的新纪元。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

本次发布除模型权重外,也包含配套技术细节与报告。

Moonshot称,其已同多家推理合作伙伴及开源维护者展开紧密协作,以保证K3能够可靠运行于主流硬件和框架。

完整权重开放后,本地部署和二次开发可由开发者下载完成;超大规模MoE、新型注意力机制等前沿课题可供研究机构依托K3探索;专属超长上下文知识系统及智能Agent集群则可由企业构建。

新一轮应用浪潮即将在开源社区出现!

参数规模:再次抬高能力天花板

开源模型的参数与能力上限,在过去一年中几乎每个季度都会被Kimi系列重新推高。

K3拥有2.8T参数,不仅跻身目前已知规模最大的开源模型之列,也是首个真正进入3T 俱乐部的模型。

与前代K2相比,K3在架构层面取得了明显突破:

面向超长序列专门设计了KDA混合线性注意力机制;

深层模型训练稳定性的提升,由Attention Residuals实现;

计算效率因MoE优化获得极大提升:结合Stable LatentMoE框架后,896个专家中只需激活16个,同时仍能保持巨量参数。

官方数据表明,这些创新使K3整体扩展效率较K2约提升2.5倍,在规模与可用性之间实现了平衡。

视觉编码器MoonViT-V2仅靠后续token预测、完全从零开始训练,并能依据语言建模目标直接调整自身表征;这构成了Kimi K3区别于Kimi K2.5的关键。

MoonViT-V2在完整训练过程里始终保持稳定。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

视觉评估结果还显示,以 SigLIP 初始化的基线模型,其表现与 MoonViT-V2 处在相当水平。

它原生支持多模态,并具备100万token超长上下文能力。

总体而言,K3综合推进了架构创新与场景适配。

Kimi K3通过开源把这一理念付诸新的实践;此前,官方技术博客已强调前沿智能属于所有人。

编程、前端开发、代码Agent以及长上下文推理等场景,均成为Kimi K3的突出表现领域;结论来自Moonshot官方与第三方评测。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

其整体智能水平已进入全球第一梯队,仅落后于少数顶尖闭源模型,并在开源阵营保持领先。

Kimi K3技术报告解读

与开源消息一同发布的,还有一份长达47页的技术报告。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

下面梳理技术报告中的核心内容。

2.8万亿参数的开源全能模型

Kimi K3证明,开源模型同样能把Scaling与Reasoning推向极致。

Kimi K3核心底座的各项数据十分亮眼:

庞大的体量:模型总参数量达到2.88万亿,每个Token的激活参数量为1040亿

百万级上下文:原生支持最高100万 Token规模的超长上下文窗口。

原生多模态:从预训练第一天开始,视觉与文本便相互交织,不需要任何后期缝合式对齐阶段。

推理期思考缩放(Test-Time Scaling):面对复杂任务,它会如同人类三思而后行;其Thinking Effort提供 Low、High、Max 多种级别。

三项架构革新:扩展效率提高2.5倍

训练3万亿参数级模型,绝不是简单增加GPU便能完成。

相较上一代 Kimi K2,Kimi K3实现了约2.5倍的整体扩展效率提升。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

这一飞跃源于其兼具巧思与力量的架构设计。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

1.混合注意力机制:KDA + Gated MLA

处理百万级上下文时,传统Softmax注意力机制会让KV Cache内存占用迅速撑满显存。为此,Kimi K3创新采用混合架构——

3层Kimi Delta Attention (KDA) 配合1层 Gated MLA,共同构成每一个Block。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

KDA(线性注意力):它负责高效混合长序列,把冗长上下文压缩为固定大小的循环状态,从而突破上下文长度带来的内存限制。

Gated MLA(全局注意力):同时周期性保留强大的全局信息检索能力。

这种3:1组合既保障长文本处理,又维持细节检索能力。

2.注意力残差(Attention Residuals)

信息经过极深网络的层层传递时往往有所损耗。为此,Attention Residuals被Kimi K3引入,使当前层能直接跨级读取此前所有层的特征表示。模型仿佛因此拥有直达电梯,信息流转的拥堵得以消除。

3.稳如泰山的超稀疏 MoE (Stable LatentMoE)

Kimi K3 的路由专家数量增加到896个,每个Token会激活16个专家。为保证极度稀疏状态下的训练稳定性,Kimi 团队采用了两项关键技术。

SiTU-GLU激活函数极端规模下激活值容易爆炸,是传统SwiGLU存在的问题,而这一问题由此得到完美解决。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

Quantile Balancing(分位数负载均衡)团队取消传统辅助损失函数,改用动态调整偏差,让896个专家保持近乎理想的负载均衡,既不会闲置也不会过载。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

K3炼成记:百万Token的Agent怎样完成进化?

大模型的能力不仅来自预训练,也取决于后训练/RL。Kimi K3的强化学习完全针对智能体拥有100万Token 超长视距进行定制。

1.白盒沙盒里的极度复杂训练 (AgentENV)

真实模拟器取代简单问答,成为Kimi K3 的训练环境;其中的沙盒由月之暗面基于微型虚拟机(microVM)开发。AgentENV

写代码、截图、查Bug并自我修正,是Kimi K3在该环境中历经的成百上千个步骤。它还要扮演人类员工,置身模拟的Slack、Notion、Gmail环境,完成跨越虚拟数天的超长待机任务。

2.由知识图谱引导任务合成

为了扩展模型见识,研发团队构建了可自我进化的知识图谱,让爬虫智能体自动从全网抓取并合成高难度验证任务,范围覆盖天体物理到前端开发,以此持续考验K3。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

3.多层思考蒸馏 (MOPD)

强化学习覆盖低、高、极限三个思考努力级别;在此过程中,Kimi K3还对代码、智能体、通用三大领域的专家模型实施了交叉训练。

这些强大能力最终汇入一个统一模型,所采用的方式是多教师在策略蒸馏(Multi-Teacher On-Policy Distillation)。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

将算力与基础设施利用推向极限

2.8T 参数与1M上下文不只考验算法,也给系统工程带来史诗级挑战。

Kimi Infra团队为这项挑战交出了出色成果。

MoonEP(零浪费专家并行):算力分配在MoonEP的在线整数线性规划与零拷贝通信下变得完全动态且绝对平衡,解决了MoE训练中常见的算力不均。

KDA融合Prefix Cache:数十万字相同前缀的请求经处理后,K3响应速度将呈指数级提升。实现这一结果的前提,是团队针对混合架构重写底层推理引擎,让MLA的KV Cache和KDA循环状态共享并复用同一个内存池。

实测能力:接近甚至超过人类极客

在报告展示的全面评测中,Kimi K3在各项公开与内部基准测试中,全面超越了Claude Opus 4.8、GLM-5.2 和 GPT-5.5,并逼近目前最强的Claude Fable 5 和 GPT-5.6 Sol。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

面对真实极客任务,Kimi K3展现出了惊人的表现。

Linux内核Zero-Day漏洞的检出(网络安全测试)

多个未知零日漏洞(Zero-Day)被Kimi K3独立从最新Linux内核代码中发现!而在极度硬核的网络安全评估里,它对已知漏洞同样能编写Exploit(漏洞利用程序)。

其中包括一个可远程触发的堆越界写入漏洞和一个本地提权漏洞,人类安全专家已经验证这些发现。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

深度改造GPU编译器

运行时间缩短70%以上、接近硬件理论极限,是Kimi K3优化KDA、DSA等极高难度大核算子后的结果。它还独立完成了名为MiniTriton的GPU编译器开发,其中具备完整代码生成管线。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

一颗芯片(Nano-KPU)的设计仅用48小时

从零设计一颗45nm工艺的AI推理芯片,是这项早期概念验证的目标。K3在沙盒中度过48小时,完全自主调用开源EDA工具完成设计、优化与验证,最终让时序成功闭合!

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

代替科研人员完成工作

K3为复现天体物理学中的某个普遍关系,先自主研读20多篇论文,再写出超过3000行Python代码建立完整数值管道;它不仅定位了已发表论文公式的矛盾点,还制作出可交互的数据面板。这项工作若由人类完成需要一到两周,K3在两个小时便完成。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

突出的性价比

性能能够比肩最强闭源模型,推理成本表现又如何?

Kimi K3呈现出极其恐怖的性价比,背后支撑包括系统底层的疯狂优化、投机解码(Draft Model)和量化感知训练(MXFP4权重/MXFP8激活)。

在第三方平台Artificial Analysis的统计中,Kimi K3在保持第一梯队性能的同时,在BrowseComp基准上单次任务的成本仅为GPT-5.6 Sol的一半,甚至比Claude Fable5便宜了近乎一个数量级!

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

硅谷共同表态:支持开源!

美国政府切断本国企业获取开源大模型渠道的做法,最近遭到近200家硅谷创始人的联合反对。

本周末,老黄在X发布人生第一推,25家企业共同署名阐述开源为何重要。

硅谷的半壁江山几乎都在这25家名单中,英伟达、微软、Meta、IBM、a16z、YC等等均位列其中。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

正处于这一关键节点,K3全面开源无疑具有更为重大的意义。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

全球第一的位置,今日仍由Kimi K3占据于Arena.ai榜单

以开源之光照亮前沿智能

面对闭源巨头,弯道超车的一次机会也来自国产开源路线。

可以预见,K3权重全面开放后,社区优化版本、本地部署方案及垂直应用将大量涌现。

闭源巨头的垄断曾因Llama开放而被Meta一举打破。全球开源AI社区由此彻底燃起热情,无数衍生模型和应用也随之诞生。

现在,以K3为代表的中国开源AI正在崛起,并可能由此重塑全球大模型的游戏规则。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

现场大屏据称展示着K3,扩容升级、K4,给我狠狠干到极致和冲上月球,地点是Kimi团队周五举行庆功活动的一家酒吧。另有爆料称,团队包下多个卡座,月之暗面联合创始人、总裁疑似也在现场

Kimi K 3.1将于下月发布的消息传出时,距离Kimi K3开放权重仅有几小时。

刚刚,Kimi K3正式开源!3万亿模型权重全球开放

虽然Kimi K3整体表现仍略逊于最强闭源模型,但它已经牢固确立了开源领域的新边界。

只有闭源巨头才能玩转百万级Agent与慢思考,这一偏见因Kimi K3横空出世而被打破。

随着代码、权重和技术细节完整开放,开源AI面前的广阔空间才刚刚展开。

资料参考:

https://huggingface.co/moonshotai/Kimi-K3

https://github.com/MoonshotAI/Kimi-K3/tree/main

https://modelscope.cn/organization/moonshotai

相关文章

精彩推荐