黄仁勋、Kimi K3,与一场即将到来的开源战争。 📅 2026/7/29 13:47:12 你要说最近AI行业里最热的、被讨论最多的一件事。那必然就是一个由老黄、Anthropic、kimi、开源这几个看着风牛马不相及的4个词共同串起的故事。故事是这样的。前几天7月24日黄仁勋发了自己在X上的第一篇帖子。这个AI圈可能最火的男人为了发这封公开信不惜注册了个X。这封信的名字叫《Open Weights and American AI Leadership》开放权重与美国AI领导力。大概意思就是AI会改造每一个行业驱动每一家公司也会被每一个国家建设。开放模型能强化安全、加快创新也能带来技术主权。这个世界既需要最前沿的闭源模型也需要最前沿的开放模型。咱们不能制裁开源模型啊。老黄之所以这么操碎了心其实是有前情提要的。我们把时间拨回11天前那天有一个标志性的事件发生。7月17日凌晨Kimi K3正式发布。2.8万亿总参数1040亿激活参数原生视觉能力100万Token上下文。最关键的是Kimi当时就承诺模型权重会在7月27日也就是昨晚正式开源。这是全球首个开源的3T级模型。一个中国团队在算力远没有那么宽裕的情况下做出了一个能力逼近全球最强闭源模型的东西还要把权重交给全世界。这一下子美国那边的气氛就变得不对劲了。7月22日美国白宫科技政策办公室负责人Michael Kratsios公开指控月之暗面声称Kimi K3的开发使用了对Claude Fable 5的大规模蒸馏。不过有趣的是评论区。大家可以看看群众的呼声。然后呢美国财政部长好死不死火上浇油又提到了贸易黑名单和制裁。评论区这下彻底沦陷了。这个事越闹越大眼瞅着一场原本关于模型能力和开源路线的竞争迅速被拖进了知识产权、国家安全、出口管制和中美科技竞争里。也就在这个时间点黄仁勋站出来了。他接受采访公开反对封禁中国开源模型。两天以后他发出了人生第一条X用一封公开信告诉华盛顿开放模型关乎美国的创新、竞争、安全和技术主权你不能封禁不能制裁我们得鼓励开源。讲道理老黄为了卖卡真的是操碎了心。然后呢在最下面一个很长的Logo墙被贴了出来整个科技行业开始排队在公开信上签名。公开信刚发布的时候签名的有25家公司和组织。英伟达、微软、Meta、IBM、戴尔、Palantir、Mistral、Hugging Face等等等等。到了周末名单开始疯狂变长。OpenAI来了Google来了SpaceX来了AMD、Cisco、Cloudflare、GitHub、Linux Foundation、Mozilla、Vercel、Y Combinator、OpenClaw等等也全都来了。到我写这篇文章的时候已经有77个签署者了。也有无数的大佬疯狂打Call站台。好久好久好久没见过这么集结一起起义同仇敌忾的了。但是如果细心的朋友就会发现上面那个logo墙几乎集结了美国绝大多数的前沿科技公司甚至英伟达和AMD都世纪同框了但是你会发现莫名其妙的怎么缺了一个熟悉的名字。Anthropic。我觉得这张世界名画可以改名叫《Anthropic在哪里》。而就在Anthropic装死美国科技巨头们联手推特上书起义之时。本次事件的导火索在昨晚也就是7月27日晚上23点13分正式官宣了Kimi K3开源。而且这个开源程度远超乎我的意料。我本来以为只是开源模型权重而已。结果。模型权重开源。详细的技术报告也放出来了。训练K3用到的关键Infra也开源。全都开。。。我大概列举一下。Kimi K3模型权重一个2.8万亿参数的MoE模型一共有896个专家每个Token激活其中16个。然后是K3完整的技术报告一共47页。这里面公开了KDA和Attention Residuals的架构细节解释了他们如何用3比1的比例混合KDA与Gated MLA如何让信息跨越几十层继续流动。还有Stable LatentMoE。896个专家只激活16个稀疏程度高得离谱Kimi又用SiTU GLU、Quantile Balancing这一整套方法把这种极端稀疏的训练维持在稳定状态。还有MoonViT V2、百万Token上下文的强化学习基础设施、大规模任务合成、后训练方法接近20个内部评测集的完整结果也放了出来。这个技术报告很详细和扎实推荐一读。除了技术报告之外还有开源的关键infra技术。MoonEP一套专门为超大规模MoE打造的专家并行通信库。MoE训练时经常会出现某些专家忙得要死某些专家闲得抠脚最后所有GPU都得等最忙的那一张卡。MoonEP会根据当前路由结果动态复制一小部分热门专家让每张卡收到完全一样数量的Token同时维持静态内存形状避免训练越跑越碎最后直接OOM。这已经属于超大模型训练里非常底层、非常值钱的东西了。FlashKDAKimi Delta Attention的高性能算子。它用CUTLASS实现在英伟达H20上相比flash linear attention基线prefill速度提升了1.85倍到2.31倍还可以直接接进现有的flash linear attention后端。再往下还有AgentENV。这是Kimi和KVCache.ai一起做的分布式Agent沙箱系统也是K3做大规模Agent强化学习时真正跑环境的那层底座。它可以在一堆机器上同时启动海量Firecracker微虚拟机环境恢复低于50毫秒暂停低于100毫秒还原生支持快照、恢复和fork。一个Agent跑到某个关键节点以后可以直接分叉成几十条互不干扰的轨迹继续并行探索。虽然我对底层技术不是很了解只是纸上谈兵的一些浅薄知识但是从这几个技术来说我觉得已经能感受到真香了。真的就是掏老底了。MoonEP解决超大MoE模型的通信和负载。FlashKDA解决新注意力架构的算子效率。AgentENV解决Agent强化学习需要的海量真实环境。开源社区要起飞了。如今我愿将Kimi和DeepSeek并称为开源二圣。我也读了一下这次Kimi K3的许可证。普通研究者、开发者和公司可以免费使用、复制、修改、部署、微调、分发也可以做衍生产品和商业化。它只给超大规模商业使用留了两道门槛。如果你做模型服务生意公司及关联方连续12个月总收入超过2000万美元需要另行和月之暗面签协议。如果使用K3的商业产品月活超过1亿或者单月收入超过2000万美元产品界面需要显著展示Kimi K3。对需要显著展示Kimi K3就行。菩萨啊。。。已经有人说如果Kimi K3能给他带来单月2000万美元的收入别说显著展示Kimi K3的品牌标识了。他可以把Kimi的logo纹在屁股上甚至可以纹两个。今天这晚随着Kimi K3的开源我感觉把整个事件推向了最终的高潮舆论基本一边倒。也在Hugging Face中创造了历史。这一刻美国的态度和Kimi K3开源有了一种神奇的化学反应。未来这件事有可能被史称为AI行业的萨拉热窝事件。这个世界需要开源。老黄他们拥抱开源当然除了理想之外还有很多金钱的气息。2002年Joel Spolsky写过一个很经典的商业规律叫Commoditize Your Complements把你的互补品变成商品。一个东西的互补品越便宜人们对这个东西的需求就越大。英伟达卖GPU。开源模型越多全球就有越多公司愿意自己部署、自己微调、自己训练最后需要的GPU也越多。AMD、戴尔、云计算公司、推理服务商逻辑差不多。GitHub、Vercel、Replit、LangChain、OpenClaw这些开发工具和应用平台也天然希望底层模型越来越多、越来越便宜、越来越容易替换。因为模型成本每降一块钱应用层就多出一块钱的空间。老黄坚定的相信开源以及老黄是开源模型的最大受益者之一这两件事不冲突的。但是我坚定的相信、也拥抱开源。原因也特别简单因为我是个普通人。这辈子我可能都训练不起K3这样的模型我没有几万张卡我什么都不懂技术报告里的公式我都只能在AI的加持下勉勉强强看懂一点点。但是不妨碍我今天踩在无数前人开源的工作、框架还有模型上来创作我自己的作品。普通人能参与每一次技术革命靠的其实就是前面那些前辈愿意把终点留下来给后来的人当起点。我们没有突然变成天才。我们只是不用从零再走一遭。开源真正厉害的力量就在这里。一个团队花掉巨大算力、无数大佬熬了很久才得到的东西一旦公开第二天就会成为全世界无数普通人的公共起点。我觉得这就是文明的复利。最后向所有为人类世界、开源世界、AI世界的大佬们。致以我最崇高的敬意。谢谢你们。以上既然看到这里了如果觉得不错随手点个赞、关注、转发三连吧这对我们有特别大的帮助!谢谢你看我的文章我们下次再见。