7月16日,月之暗面发布2.8万亿参数的Kimi K3,一举登顶Arena AI前端编程榜。两天后,马斯克在X上撂下一句话:“我们的2T模型下周完成初始训练,有可能超越Kimi。”
从点赞到宣战,只隔了48小时。
一、Kimi K3:让马斯克连点两次赞的中国模型
Kimi K3的参数规模达2.8万亿,是全球参数最大的开源模型。它原生支持视觉输入,拥有100万Token上下文窗口,采用KDA混合线性注意力加Attention Residuals,配合896个专家的MoE架构,每次仅激活16个。
在Frontend Code Arena榜单上,K3以1679分登顶,超越Claude Fable 5的1631分和GPT-5.6 Sol的1618分。在Program Bench上得分77.8,超过GPT-5.6 Sol的77.6;FrontierSWE得分81.2,大幅领先GPT-5.6 Sol的71.3。
发布当天,马斯克在相关评测报道评论区留言:“令人印象深刻。”这是他继2026年3月点赞Kimi底层架构技术报告后,第二次公开认可这家中国AI团队。但仅仅一天后,态度就从赞叹转为对标。
二、Grok 4.6:2万亿参数,下周见
7月18日,马斯克在X上透露,xAI正在训练的下一代Grok 4.6模型参数规模达到2万亿,预计下周完成初始训练。
马斯克表示,2万亿参数模型“在各方面都优于当前的1.5万亿参数版本”,推理速度和Token效率将接近Grok 4.5。至于能不能打过Kimi,他的原话是:“It might be able to exceed Kimi”——“有可能超越”。
“有可能”三个字,对于习惯用“碾压”形容自家产品的马斯克来说,几乎是罕见的谦逊。
算力层面,Grok 4系列依托代号“Colossus”的超大规模AI算力集群,搭载约20万块GPU。xAI的目标很明确:在扩充模型规模的同时稳住前代产品的运行效率,兼顾性能与使用成本。
三、一场“2万亿vs2.8万亿”的错位竞争
单纯从参数规模看,Grok 4.6(2万亿)与Kimi K3(2.8万亿)并非同一量级——K3领先40%。但参数只是体量指标,模型实际能力还取决于训练数据质量、算法框架、推理架构、算力供给及后训练优化等多重因素。
换句话说,2万亿未必打不过2.8万亿。
更值得关注的是xAI的迭代节奏。2026年5月,1.5万亿参数的Grok基础模型V9-Medium完成主体训练。Grok 4.5于7月8日发布。Grok 4.6下周完成初始训练。xAI计划到2026年12月,每月发布从头训练的全新模型。月更旗舰——这种节奏在整个行业里都极为罕见。
四、行业震荡:从“DeepSeek时刻”到“Kimi时刻”
Kimi K3发布当天,美股盘前纳斯达克100指数期货一度跌逾1.8%,英伟达等AI龙头普遍走低,市场重现“DeepSeek时刻”。
马斯克的入局让这场竞赛再添一把火。Kimi官方账号的回应颇为俏皮:“@ElonMusk 欢迎加入「2万亿+」俱乐部”。Kimi创始人杨植麟的导师则直接喊话马斯克:“如果你想把自己比作Kimi,那就和Kimi一样开源你的模型”。
从“令人印象深刻”到“可能超越”,马斯克的态度转变本身就是一则信号。正如外媒所评价的,当马斯克面对一款中国大模型时罕见地换上“可能超越”这样谨慎的措辞,这场由Kimi K3引发的AI竞速,已然成为全球AI格局攻守易势的标志性瞬间。
Grok 4.6能不能真正超越Kimi K3,几周后自有分晓。但有一件事已经确定:中国大模型第一次让硅谷的头部玩家坐不住了。

