
美国财长亲口说,要查中国模型是不是"偷"了美国技术,还点名了"模型蒸馏"这个技术动作。制裁的话也放出来了,就看调查结果。
但这件事的导火索是什么?是月初月之暗面发布的Kimi K3模型,在好几个行业基准测试里把OpenAI和Anthropic的产品给超了。
跑分超车这种事,最能刺激美国那根敏感的神经。以前都是美国领跑,现在中国模型追上来了,而且还不是一个两个,是一批一批地冒出来。

贝森特在福克斯商业频道上讲得很直白,说发现中国模型里有美国大语言模型的"数字水印",这就是证据。
但稍微了解AI技术的人都清楚,数字水印这玩意儿的指向性没那么强。
它更多是用来标识数据来源的技术手段,本身并不能直接证明"盗用"。更关键的是,蒸馏技术在国际AI学术界早就是公开的研究方法,大量论文都在讨论如何通过蒸馏提升小模型性能。
把一种公开的技术路径直接等同于"盗窃",这个逻辑跳跃幅度有点大。
美国现在最尴尬的地方在于,他们对中国的AI技术优势正在缩水。

以前还可以靠算力卡脖子,靠高端芯片禁运拖慢中国训练大模型的速度。但中国企业的应对比想象中快得多,昇腾算力集群的部署规模在扩大,国产大模型在架构设计和训练效率上也在不断优化。Kimi K3的出现就是一个信号:单靠硬件封锁已经拦不住了。
所以美国现在换了个角度,从"知识产权"入手。贝森特这招说白了就是换个地方砌墙,以前砌的是硬件墙,现在想砌技术墙。
但美国这套"知识产权卫士"的人设,恰恰被自家的官司打得千疮百孔。
Anthropic上个月还在给美国参议院写信,说阿里巴巴搞"蒸馏攻击",结果这家公司自己在去年9月因为非法下载盗版书库训练模型,乖乖掏了15亿美元跟作家们和解。15亿美元什么概念?很多AI初创公司整个融资额都没这个数。

还有《纽约时报》跟OpenAI的官司,2023年就开打了,指控OpenAI和微软未经授权就用报纸的内容去训练AI。这两个案子摆在那里,说明美国AI巨头自己的训练数据来源本身就布满灰色地带。
一边是自己在法庭上为版权侵权买单,一边是财长在电视上义正辞严说要保护知识产权。这种反差,明眼人都看得到。
贝森特说"未来几天或几周内"会深入调查,这个时间点也很有讲究。路透社已经报了,中美计划9月就AI议题会谈,贝森特要代表美方出席。会谈前放风要调查、要制裁,这是典型的谈判施压套路。
对中国企业来说,这波制裁威胁的实际影响需要分开看。
短期来看,如果美国加码出口管制,对高端AI芯片的获取肯定会造成干扰。尤其是训练超大参数模型需要的H100、B200这类GPU,本来就供不应求,如果限制再加严,国内算力缺口会进一步扩大。

但中长期来看,这种压力反而加速了国产替代的进程。华为昇腾的生态在快速补齐,寒武纪、海光信息等国产芯片厂商也在迭代新产品。
国内大模型公司已经开始探索混合精度训练、模型并行等工程手段来降低对单一算力品牌的依赖。算力不够,算法来凑,这条路虽然难走,但已经在走了。
另外值得注意的一点是,美国这次打的是"蒸馏"牌,这个选择本身就透露了他们的焦虑。
蒸馏技术本质上是一种模型压缩方法,它依赖的是"教师模型"的输出概率分布,而不是对源代码或者模型参数的直接盗用。
在AI研究领域,通过API调用获取模型输出并进行蒸馏,长期以来是一个存在争议但法律界定并不清晰的地带。
美国如果真要在这个领域立法或制裁,面临的将是一个巨大的技术监管泥潭。因为全球数以万计的研究团队每天都在用蒸馏技术做实验,美国不可能把所有使用过蒸馏方法的人都定义为"盗窃者"。

中美AI博弈现在是越收越紧。从芯片到算法,从人才到数据,每一个环节都被搬上了棋盘。贝森特这次拿"蒸馏"说事,只是新一轮较量的开场白。
但有一点可以确定:中国AI产业经过这几年的技术积累和供应链重构,抗压能力比2022年芯片禁令刚出台时要强得多。
美国每次出招,短期会有阵痛,长期却往往是中国技术自立的催化剂。
制裁威胁听听就好,关键还是把手头的事干扎实。
算力短板继续补,算法优势继续放大,应用场景继续铺开。
中国AI的底气从来不来自别人的施舍,而来自自己的市场规模、数据资源和工程化能力。

贝森特想用"蒸馏"这根棍子来敲打中国,但中国AI这趟列车,早就不是一根棍子能拦得住的了。
9月的AI会谈,贝森特带着调查结果来,中国带着自己的技术实力去。
谁手里有真东西,到时候自然见分晓。