昨晚,Moonshot AI把Kimi K3的完整权重扔上了HuggingFace。
2.88万亿参数。这是全球第一个真正落地的"3T俱乐部"开源模型。没有阉割版,没有preview,没有"稍后开源"。一次全开。让整个科技圈真正坐不住的,是同一份47页技术报告里藏着的那几段话:Kimi K3在最新Linux内核里,独立发现了多个零日漏洞。包括一个远程触发的堆越界写入,一个本地提权。这些漏洞已得到人类安全专家的验证。换句话说:一个开源AI,自己挖出了Google Project Zero还没公开的安全洞。然后它干了第二件事:48小时从零设计出一颗45nm工艺的AI芯片。在沙盒里被关两天,它自主调用开源EDA工具,从设计、优化到时序闭合,全部自己跑完。第三件事更冷门:阅读20篇天体物理论文,写3000行Python复现数值管道,找出已发表公式里的矛盾点,生成可交互面板。人类需要一两周,它用了两小时。架构上它做了三件事
第一,混合注意力。每4层block里塞3层KDA线性注意力+1层Gated MLA。百万token上下文不再爆显存,长文本和细节检索两不误。第二,注意力残差。深层网络的信息损耗问题,让当前层可以跨级读取所有前层特征。模型装了直达电梯。第三,896个专家只激活16个。SiTU-GLU激活函数+Quantile Balancing分位数均衡,让极度稀疏的MoE稳如老狗。整体扩展效率比K2提升2.5倍。成本才是杀招
性能刚摸到Claude Fable 5和GPT-5.6 Sol的脚后跟,但价格不是。Artificial Analysis的数据:BrowseComp基准单次任务成本,K3只有GPT-5.6 Sol的一半,比Claude Fable 5便宜近一个数量级。量化感知训练(MXFP4权重/MXFP8激活)+ 投机解码 + 配套开源的FlashKDA kernel(H20上prefill提速1.72–2.22倍)+ Day 0合作伙伴Modal的推理部署——这套组合拳,是把"用得起的开源前沿模型"从口号变成账单。为什么这次开源不一样
过去中国大模型开源,要么丢个残血版,要么藏核心infra。这次Moonshot一口气把三件东西全部端上桌:- Kimi K3模型权重(HuggingFace + GitHub + ModelScope三站同步)
- FlashKDA —— CUTLASS高性能attention kernel实现
- AgentENV —— 与kvcache-ai合作开源的分布式智能体训练环境
加上配套的MoonEP专家并行方案,等于把模型+kernel+训练沙盒+并行策略四块底牌全翻出来。这不是"我开源你用"的姿态。这是"我把入场券撕碎了你随便进"的姿态。此刻的Arena.ai榜单
开源权重发布几小时后,消息已经在X上扩散:近200家硅谷创始人联名反对切断美国企业获取开源大模型的渠道。黄仁勋发了人生第一推,25家企业联合署名支持开源——英伟达、微软、Meta、IBM、a16z、YC都在名单里。在这个时间点,K3的全面开源,已经不是一个商业决策。据传Kimi K3.1将于下月发布。Moonshot团队周五酒吧庆功的现场大屏上已经写着——"K4,给我狠狠干到极致"。