7月1日,Anthropic发布了其最强模型Claude Fable 5。15天后的7月16日,中国AI公司Moonshot推出了Kimi K3——一个拥有2.8万亿参数、896个专家的开源权重模型,号称性能逼近Fable 5。又过了6天,7月22日,白宫科技政策办公室主任Michael Kratsios在X上投下一枚重磅指控:Moonshot在开发K3时对Fable进行了大规模蒸馏,并利用泰国服务器绕开美国芯片出口管制获取了英伟达GB300芯片。仅仅几小时后,美国财政部长Scott Bessent跟进表态:制裁和实体清单就在桌上。
15天——即便算上提前的内测窗口,这个时间也短得令人怀疑,一篇完整的模型蒸馏论文通常需要数月。Kratsios的指控究竟是掌握了实锤,还是为一场更严厉的管制铺路?
24小时内,从技术指控到制裁威胁
7月22日午后,Kratsios在X上发帖,称美方掌握信息表明Moonshot AI在开发K3模型时蒸馏了Anthropic的Fable。他进一步指控,Moonshot构建了一套“精密的内部平台”来对美国模型进行大规模蒸馏,能够“在不同访问方式之间快速切换以避免检测”。他还声称Moonshot已获取了配备英伟达GB300的服务器,并在泰国接入GB300用于训练其AI模型。GB300属于英伟达Blackwell系列芯片,美国严格禁止向中国公司出售。
几小时后,财政部长Bessent在X上发文回应:
开源不是美国IP的狩猎季。当中国公司进行跨越红线的、隐蔽的、工业级规模的蒸馏攻击时,制裁和实体清单就在桌上。
这并非Bessent首次发出警告。就在前一天,他已在Fox Business上表示,美国政府将审查来自中国的开源模型是否存在知识产权盗窃行为,并威胁在确认后实施制裁。“我们支持开源模型,但绝不支持IP盗窃,”他说。Kratsios的原始帖文在X上获得了超过190万次浏览。
时间线悖论:15天如何蒸馏出一个2.8万亿参数模型?
Fable 5在7月1日发布。Kimi K3在7月16日发布。即使Moonshot在Fable发布前就通过内测API获取了访问权限,满打满算也只有不到一个月的时间窗口。
Kimi K3是一个拥有2.8万亿参数、896个专家的混合专家模型,上下文窗口达到100万token。它是迄今为止发布的最大规模开源权重模型,超过了DeepSeek V4 Pro的1.6万亿参数和智谱GLM 5系列的7440亿参数。在Moonshot自己的基准测试中,K3接近了Claude Fable 5和GPT-5.6 Sol的水平,并全面超越了Claude Opus 4.8和GPT-5.5。
用短短15天蒸馏出一个在此量级上接近前沿水平的模型,这在技术上是极不寻常的。Hugging Face CEO Clem Delangue在TechCrunch的播客中曾指出:
蒸馏在创造优秀模型的能力中只占很小一部分,而且这是每个人都在做的,包括美国公司。如果仅仅靠蒸馏就能轻松造出好模型,那么美国早就有更多更好的开源AI了。真正的原因是,中国拥有非常优秀的研究团队,并且采取了比美国更加开放和协作的AI研究方式。
蒸馏指控的前世今生:从Anthropic到白宫
这并非美国方面首次指控中国AI公司进行蒸馏。2026年2月,Anthropic曾公开指控DeepSeek、Moonshot和MiniMax三家中国AI实验室通过约2.4万个虚假账户生成超过1600万次与Claude的交互,以系统性地提取Claude的能力用于改进自身模型。Anthropic称这些实验室“针对了Claude最具差异化的能力:智能体推理、工具使用和编程”。
但Anthropic的指控发生在2月,而白宫层面的指控在7月才正式落地。中间这5个月,发生了什么?答案是:中国开源模型的能力跃迁。
DeepSeek V4 Pro的1.6万亿参数、智谱GLM 5.2的7440亿参数,再到Moonshot的Kimi K3的2.8万亿参数——中国AI公司正在以美国实验室无法忽视的速度接近前沿水平。K3不仅在性能上逼近Fable 5和GPT-5.6 Sol,在价格上更是碾压:K3的输入价格仅为3美元/百万token,而Fable 5为10美元,GPT-5.6 Sol为5美元。在Artificial Analysis的评估中,K3每任务成本约0.94美元,接近GPT-5.6 Sol的1.04美元,但仅为Opus 4.8的1.80美元的一半。
当一个中国开源模型在性能上接近美国最前沿的闭源模型、价格却仅为三分之一时,产业链的逻辑就发生了根本性变化。
制裁升级:从芯片到模型,下一步是什么?
美国对华AI管制的逻辑链条正在肉眼可见地升级。
最早是芯片出口管制。2022年10月以来,美国禁止英伟达向中国出售A100、H100、B200、GB300等高端芯片。随后是算力基础设施管制,限制中国公司在海外如泰国、新加坡建设算力中心。Kratsios指控Moonshot在泰国接入GB300,正是针对这一层。
现在轮到模型本身管制。Bessent暗示的制裁和实体清单,以及Axios在7月20日报道的特朗普政府正在考虑全面禁止中国开源模型——这将是前所未有的升级。
如果美国真的禁止中国开源模型,将意味着什么?OpenAI战略未来主管Dean Ball(前白宫AI顾问)已经公开呼吁对中国开源权重模型施加监管压力。但特朗普的AI与国防顾问David Sacks则称Ball的提议“不可接受”。
更深层的矛盾在于,美国科技巨头自己也在大量使用蒸馏技术。微软CEO Satya Nadella在7月初公开批评大模型公司对此采取双重标准:
模型提供商对公共数据拥有合理使用权的创新是必要的,但我觉得讽刺的是,现状却是他们反过来对蒸馏施加限制性条款。
同样值得玩味的是,就在本周,Anthropic自身的版权纠纷案刚刚获批和解。一名法官裁定Anthropic非法下载和存储了数百万本受版权保护的书籍用于训练其AI,Anthropic同意支付15亿美元和解金。当一家指责别人“偷”的公司自己也在为版权侵权买单时,关于“IP盗窃”的叙事就变得复杂了起来。
焦虑的终点
这场指控的实质,或许从来不是Moonshot到底有没有蒸馏Fable。15天的时间窗口、2.8万亿参数的规模以及行业多方对蒸馏作为普遍实践的共识,都让这个指控的“技术含量”存在疑问。
真正的故事是:当中国AI公司以三分之一的价格做出接近前沿水平的开源模型时,美国政府的工具箱里剩下的选项已经不多了。芯片管制没能阻止中国AI的前进——DeepSeek、Moonshot、智谱的模型迭代速度证明了这一点。算力基础设施管制也在被绕开。现在,最后的防线变成了模型本身。
但对中国开源模型实施禁令,将是一把双刃剑。它可能保护美国AI公司的商业模型和融资能力,但同时也将切断全球AI社区对最先进开源模型的访问,并可能加速中国建立自己的AI生态闭环。而对于开源社区来说,一个更棘手的问题悬而未决:当开源模型本身已经成为大国博弈的筹码时,开源精神还能存活多久?
蒸馏从来不是中国AI的独家武器。但当它成为制裁的理由时,真正被蒸馏的,或许不只是模型能力,还有整个开源生态的信任基础。






快报