7月27日晚11点,月之暗面兑现了11天前的承诺。Kimi K3的完整模型权重正式上传至Hugging Face,技术报告同步发布于GitHub。
从7月16日以托管API形式首发,到7月27日权重全面开放,中间只隔了11天。但这11天里发生的事情,已经远超一个模型发布的范畴。
一、参数规模:开源模型首次跨入“3万亿俱乐部”
Kimi K3总参数2.8万亿、激活参数1040亿,支持100万Token上下文窗口,是全球首个进入3万亿参数级别的开放权重模型。
模型采用混合专家(MoE)架构,896个路由专家、每个Token仅激活16个。架构上搭载三项自研创新——Kimi Delta Attention(KDA)混合线性注意力、Attention Residuals注意力残差、Stable LatentMoE专家路由机制——让模型规模化效率较上一代K2提升约2.5倍。
技术报告共47页,完整披露了KDA与Gated MLA混合注意力结构、MoonViT-V2视觉编码器训练方案以及后训练与评测方法。
二、性能:前端编程登顶全球第一
在Artificial Analysis智能指数上,Kimi K3综合得分57分,位列全球第三,仅次于Claude Fable 5和GPT-5.6 Sol。
但在Frontend Code Arena编程榜单上,K3以1679分登顶全球第一,成为首个在该榜单超越所有闭源模型的开源模型。七个前端细分领域,拿下六个第一。
成本优势同样明显。BrowseComp基准单次任务成本仅为GPT-5.6 Sol的一半,较Claude Fable 5便宜近一个数量级。硬件部署成本仅需2000万元,4000万元即可流畅使用。
特斯拉CEO马斯克在相关评测下留言:“令人印象深刻。”
三、开源协议:第一次把“云厂商搭便车”写进条款
Kimi K3的License值得单独拎出来说。
协议规定:任何向第三方提供K3推理或微调服务、且年收入超过2000万美元的主体,必须与月之暗面另签协议;月活超1亿或月收入超2000万美元的商业产品,须在界面显著标注“Kimi K3”。
这是中国头部模型公司首次在开源协议中,把“云厂商搭便车”写成了明码标价的商业条款。小开发者和研究者零门槛进入,大玩家该付费付费——这与Meta的Llama License思路类似,但执行细节不同。
随权重同步开源的还有三项基础设施技术:MoonEP高性能专家并行通信库、FlashKDA高性能计算算子(H20上Prefill速度提升1.72至2.22倍)、AgentEnv沙箱系统。
四、市场震荡:3140亿美元估值蒸发
K3权重开源的连锁反应,首先体现在资本市场上。
华尔街分析师估算,OpenAI与Anthropic的合计估值预期因此蒸发约3140亿美元,英伟达单日市值亦缩水1111亿美元。港股Z.ai盘中暴跌30%,MiniMax跌16%。彭博社评价称,Kimi K3“正在搅动全球科技市场”。
与此同时,月之暗面日收入暴增至少6倍,估值锚从200亿美元急剧抬升至500亿美元。摩根士丹利评价称,K3证明中国大模型在模型规模、性能、定价三个层面对美国头部模型实现了“全方位追赶”。
五、地缘政治:白宫已经盯上了它
技术之外,地缘政治的影子已经落下。
白宫科技政策办公室主任公开指控月之暗面对Anthropic发动了“史上最大规模的蒸馏攻击”——通过25000个虚假账户进行了2900万次交互。财政部长放话制裁。美国众议院“中国委员会”主席呼吁特朗普政府采取行动。
K3选择在7月27日晚11点开源,这个时间点恰好对应美国东部时间的上午——显然是想给刚上班的美国人一点“震撼”。
而华为昇腾CANN在K3开源的Day0就完成了推理适配。从芯片到模型,国产AI技术栈的闭环正在加速成型。
六、结语
Kimi K3的权重落地,颠覆的远不止是一个技术排位。
它用一个3万亿参数的开源模型证明:开源阵营第一次站上了世界前沿;它用一份精心设计的License,为开源模型的商业化探索了一条新路;它用3140亿美元的估值蒸发,让华尔街重新评估闭源AI的定价逻辑。
正如月之暗面在公告中所说:“前沿智能属于所有人。”而Kimi K3,正在把这个口号变成一行可以下载的代码。



