一边是每年高达6.02亿美元的成本节省,另一边是可能触发美国政府审查甚至禁令的政治风险。微软正站在一个前所未有的十字路口。
推理成本高企,Copilot成了“烧钱机器”
Copilot当前的底层模型主要依赖OpenAI的GPT和Anthropic的Claude。但两家厂商近年来持续上调价格,并陆续抛弃此前“无限量使用”的套餐模式,这使微软在为客户提供服务时面临愈发沉重的成本负担。
成本压力从“tokenmaxxing”一词可见一斑——大模型推理令牌消耗飙升。微软甚至已经开始将其代理式AI解决方案转向基于使用量计费的模式,同时寻找更便宜的模型以压低单次调用成本。
正是在这种背景下,微软将目光投向了中国。
Kimi K3:性能媲美顶级模型,价格只有四成
微软目前正在评估将中国AI公司月之暗面研发的Kimi K3开源模型引入Copilot服务。
Kimi K3是全球参数规模最大的开源模型,总参数达2.8万亿。它采用MoE架构,拥有896个专家,每次仅激活其中16个,支持100万Token的超大上下文窗口和原生多模态能力。
性能上毫不逊色:在编程能力评测中,K3在Program Bench上得分77.8,超过GPT-5.6 Sol的77.6;在权威的Text Arena综合排行榜中,Kimi K3以1486分位列第9名。
微软已将Kimi K3添加到Azure云服务中,Copilot工程师正评估该模型能否替代OpenAI和Anthropic的现有系统。
更早之前,微软也评估过在Copilot Cowork中使用中国开源模型DeepSeek-V4的变体。这被视为其进一步摆脱与Anthropic、OpenAI深度捆绑的战略举措。
6.02亿美元:一个无法忽视的数字
微软内部测算显示,若将Copilot从OpenAI和Anthropic的模型切换至Kimi K3,推理成本最高可节省6.02亿美元,约合40亿元人民币。单个Token推理成本最多可节省60%。
对任何一家企业来说,每年省下40亿元都是极具诱惑力的商业决策。有分析指出,若微软将Kimi K3纳入Copilot服务,其本质并非单纯技术替代,而是对当前AI算力供应链的一次结构性再平衡——可能加速算力采购向定制化推理芯片与混合部署架构迁移。
政治红线:特朗普政府的“中国AI禁令”阴影
然而,这项极具商业诱惑力的决策正面临着严峻的外部政治考量。
特朗普政府近期对人工智能模型加大审查力度,尤其对由外国机构开发、训练和运营的模型表现出强烈戒心。政府已公开威胁要打击部分中国AI企业,并曾讨论禁止包括DeepSeek在内的部分中国模型进入美国市场。Axios报道称,美方正考虑对中国AI模型实施限制甚至禁令。
如果在旗舰产品中深度整合中国开源技术,微软极有可能招致白宫方面的强烈不满与审查。即便企业在技术和数据治理层面可以接受多模型并存的架构设计,一旦相关模型不直接受美国公司控制,便要承担来自政府审查、出口管制与合规不确定性的额外风险。
更值得注意的是,成本节约预期本身可能加剧监管关注:模型替换若涉及跨境数据流、训练数据溯源或终端用户提示义务变更,将触发多司法辖区的合规重审。
纳德拉的算盘:不想被少数巨头“卡脖子”
微软CEO萨提亚·纳德拉近期在X平台发表长文《没有生态系统的前沿并不稳定》,指出让少数几家巨头垄断前沿AI能力,从长期看既不利于经济发展,也不利于社会整体利益。
在结束与OpenAI“高度捆绑、关系紧张”的阶段后,微软正主动尝试降低对少数几家头部厂商的依赖,并通过引入更多模型选择来重塑自身在AI生态中的位置。这一举动也被视为微软向行业发出的信号:大型科技公司可以也应该探索更加多元的模型来源。
结语
省40亿,还是惹特朗普?微软正站在十字路口。
Kimi K3的性能和成本优势让微软难以忽视,但政治风险同样不容小觑。如果微软最终选择在Copilot体系中引入中国模型,无论采取何种技术和合规防护措施,都很难获得特朗普政府的善意回应。
这场博弈的最终结果,不仅关乎微软一家公司的成本账本,更将深刻影响全球AI产业的供应链格局——以及中美科技竞争的下一块棋盘。


