据The Information报道,微软正在内部测试月之暗面(Moonshot AI)的Kimi K3大模型,评估将Copilot部分推理请求从OpenAI和Anthropic的模型迁移至K3。
微软内部测算,此举每年最多可节省约6亿美元云基础设施成本,折合人民币超40亿元。
消息发酵的同一周,华盛顿迅速跟进。
据Axios报道,特朗普政府正考虑以行政令限制中国开源模型在美使用;7月22日,美国总统科技顾问克拉齐奥斯(Michael Kratsios)公开发文,指控月之暗面对Anthropic模型实施“大规模、隐蔽的工业级蒸馏”。
用中国模型替换美国头部模型,微软不是第一个动念的美国公司——从编程工具Cursor到OpenAI前CTO穆拉蒂创办的Thinking Machines,美国企业早已开始用脚投票,Kimi K2系列正是被选中的对象之一。
本次微软引发市场关注则是因为它的特殊身份:OpenAI最大投资方。
预计降本超40亿元Copilot是微软AI战略的核心产品,目前大量调用OpenAI的GPT系列与Anthropic的Claude系列模型。
自Copilot Cowork转向按Token消耗计费的计量定价模式后,推理成本成为微软最直观的可变成本——每一次用户请求,都对应着实打实的算力与电力支出。
微软内部估算,若将部分Copilot请求切换至Kimi K3,每年最多可减少约6亿美元云基础设施成本,单个Token推理成本最多可下降60%,相当于微软2026财年第三财季智能云部门净利润的15%。
微软将在未来两个月内完成初步技术验证,同时已在推进Kimi K3上架Azure云服务。
Kimi K3于7月16日上线,总参数2.8万亿,为全球参数规模最大的开源模型。
独立评测机构Artificial Analysis的“智能指数”显示,K3综合得分57分位列全球第三,仅次于Claude Fable 5和GPT-5.6 Sol;在前端编程榜单Frontend Code Arena上登顶全球第一。
成本层面,启用最大推理档位的K3任务均价约0.94美元,介于GPT-5.6 Terra(0.55美元)与GPT-5.6 Sol(1.04美元)之间,其效率优势主要体现在数据中心侧的大规模运行成本上。
值得注意的是,微软关注K3的重点并非前沿能力对标,而是代码补全、基础问答等非核心场景的成本效率。
用脚投票的不止微软美国企业转向中国模型,早已不是个案。
模型调用平台OpenRouter的数据显示,2026年2月以来,中国模型在美国企业经该平台调用的Token中,每周占比均超过30%,峰值一度达46%——而2025年上半年,这一数字仅为4.5%。
原因并不复杂,中国开源模型的使用成本比Anthropic和OpenAI的领先模型便宜60%至90%。
AI编程工具Cursor在开发Composer 2时测试了多款基础模型,最终选择Kimi K2.5,理由是评测表现最强;OpenAI前CTO穆拉蒂创办的Thinking Machines,其首款模型Inkling的架构主要沿用DeepSeek-V3,后训练冷启动还使用了Kimi K2.5生成的数据;AI创业公司Lindy今年6月将全部流量从Claude切换至DeepSeek,其CEO对CNBC形容“成本曲线直接崩落到地板上”,预计数月内节省数百万美元;桥水基金则通过微调平台定制阿里Qwen,以更低成本获得了超过部分顶级闭源模型的表现。
微软自己的铺垫也早有迹可循。
微软云服务Azure此前已接入Meta的Llama、Mistral等第三方模型,本月还与Mistral扩大战略合作;今年6月,微软考虑采用深度求索的V4或类似模型,托管于自有基础设施;月之暗面前代代码模型Kimi K2.7 Code已登陆Azure,用于GitHub Copilot。
微软CEO纳德拉近期更是多次公开强调成本效率与供应商多样性。
不过这并不意味着微软要和OpenAI切割,有分析人士指出,即便微软最终采用K3,也更可能限于非核心、低敏感度任务,占Copilot总请求量比例有限,与OpenAI的独家云合作不会轻易改变。
美国闭源阵营,急了当美国企业面对愈发高企的闭源模型成本,尤其是Kimi K3引发全网热议并开始用脚投票时,靠模型定价权吃饭的两家闭源巨头反应相当激烈。
OpenAI战略未来主管迪恩·鲍尔(Dean W. Ball)公开发帖,一边承认K3是“非常优秀的模型”“不能简单归因于蒸馏”,一边断言开放权重模型“本质上是减速主义的”,会削弱前沿模型的商业回报、阻碍AI资本支出。
更具争议的是,他公开建议美国政府“不需要证据”,只需以“中国模型可能存在后门”之类的软性法规制造监管恐慌,“让每个受监管的企业都退缩”。
鲍尔曾任白宫科技政策办公室高级顾问,本月刚加入OpenAI,其言论随即被硅谷投资人斥为“闭源双头垄断借政府之手消灭开源对手”的“监管俘获”。
OpenAI总裁布罗克曼(Greg Brockman)的口径相对克制。7月21日他承认月之暗面开发出了“具有竞争力的模型”,称判断其是否通过“蒸馏”非法提取OpenAI模型输出“还为时过早”,但强调“这是我们一直在监控的事情”。
Anthropic则延续了其一贯对中国模型厂商的攻击。CEO阿莫代伊在出席美国国会AI安全听证会时声称,K3蒸馏了其模型,甚至包括一款“尚未公开的未来模型”。
7月22日,美国总统科技顾问克拉齐奥斯公开发文,称“美方掌握的信息显示”月之暗面在开发K3时对Anthropic的前沿模型Fable进行了“大规模、隐蔽的工业级蒸馏”,并指控其搭建可规避检测的内部蒸馏平台、采购搭载英伟达GB300芯片的服务器并曾在泰国使用相关算力。
他同时表示,“合法蒸馏是开放创新生态的重要组成部分”,但以窃取专有技术为目的的秘密工业蒸馏“不可接受”。
月之暗面方面迅速否认。副总裁黄震昕7月21日表示:“Kimi K3性能实现跨越式提升,核心依托底层原创架构创新,并非对任何现有模型进行蒸馏复刻。”
团队成员Randy Xia则以时间线反讽:Fable于7月1日发布,K3于7月15日上线——“我们仅用15天就训练出一个全新的前沿模型,这简直创造了吉尼斯世界纪录。”
事实上,“蒸馏指控”已成一套美国AI企业的惯用叙事模板。
今年2月,Anthropic曾指控DeepSeek、月之暗面、MiniMax三家中国公司发起“工业规模蒸馏攻击”;6月又致信美国参议院,指控阿里巴巴实施“最大规模蒸馏攻击”。相关指控至今未见公开证据链,但每一次都精准踩在中国模型性能跃升的节点上。
从性能竞赛到成本竞赛在白宫官员已公开点名月之暗面的背景下,微软任何实质性的切换动作,都将被放在放大镜下审视。
但跳出个案,这一周的连环动态确认了一个行业拐点:企业客户正从“唯性能论”转向性能、成本与稳定性的综合平衡,推理成本成为大模型商业化落地的核心变量。
K3发布后72小时内,美股AI板块合计蒸发约4700亿美元,费城半导体指数创2025年4月以来最大单周跌幅;《财富》杂志称之为“第二次DeepSeek冲击”。
Hugging Face机器学习负责人Yacine Jernite点明了背后的结构性趋势:“企业越来越希望转向成本更低、自身可掌控和定制的AI技术栈,而鉴于当前开源和开放权重模型的现状,这往往意味着借助中国模型。”
从DeepSeek到Qwen、GLM再到Kimi,中国开源模型正集体占据全球推理成本曲线的低位区间,同时把性能差距压缩到“够用”范围之内。微软的这笔测算,第一次把这个行业内心照不宣的事实,用美元明码标价地写了出来。
而闭源阵营这一周的反应烈度——从“减速主义”定性,到“未来模型泄露”指控,再到白宫官员亲自下场——恰恰从反面印证了威胁的真实程度。
6亿美元的账最终能否兑现,取决于技术验证、合规审查与华盛顿的风向;但可以确定的是,大模型竞争的下半场,账本的权重正在超过榜单。