贝森特说中国AI“偷”了美国模型,黄仁勋一句话让他下不来台
10月3日,美国财长贝森特对着Axios的镜头说了一句话:“中国AI模型正在进行工业级蒸馏,这是窃取美国模型的委婉说法。”
他还补了一刀,点名Kimi:“Kimi认为自己是Claude,Kimi会告诉你它就是Claude。”
这话听着像段子,但说这话的人是财长,我要说的是:这不是技术判断,这是政治定性,而定性这件事,最怕碰到懂行的人。
蒸馏到底是什么
打个比方,一个大模型像一位知识渊博的老教师,但开销大、跑得慢。蒸馏,就是让老教师把解题思路教给一个更聪明的学生,学生学到了本事,但个头小、花钱少、跑得快。
这个技术2015年就被正式提出,谷歌、微软、苹果都在用,苹果用蒸馏做手机端精简模型,Meta的扎克伯格还专门发文呼吁保护模型间互相学习的原则。
把蒸馏说成“窃取”,相当于说学生跟老师学了解题方法也算偷,这话搁在AI圈子里,没人接得住。
英伟达CEO黄仁勋被问到蒸馏算不算“劫掠”时,回答很干脆:“这叫做竞争。你完全可以尽情测试别家的产品。”他还说了一句大实话:“我当然希望没有任何人研究借鉴我们的产品,但说实话,竞争会让所有事物变得更好。”
黄仁勋说的是常识。贝森特说的是政治。
“偷”这个字,用得最没底气
贝森特说中国AI“之前并没有意识到自己的开源模型有多强大”,这句话本身就是一个逻辑漏洞。
如果模型全是偷来的,拿到手的人怎么会不知道分量?只有自己一步步研发、一步步迭代出来的东西,才会在跑通之后突然发现:原来已经走到了这么靠前的位置。
数据也能说明问题,Hugging Face平台上,过去一年41%的大模型下载量来自中国研发的模型,超过美国的36.5%。中国开源大模型全球累计下载量突破100亿次。
这个数字不是靠“偷”能偷出来的,背后是大量工程师日夜开发、迭代、优化。
更有意思的是美国企业自己的选择,美国法律AI公司哈维发布的模型Tenet,是基于中国月之暗面的Kimi K3开发的。
AI编程平台Cursor的Composer模型也是以Kimi为基础,美国AI初创公司Lindy把全部流量从Anthropic的Claude切换到了中国的DeepSeek,CEO说成本曲线“断崖式下跌”。
近200家美国初创企业曾联名敦促美国政府不要切断对中国开源模型的访问,理由很简单:这样做会削弱美国企业的竞争力。
中国商务部9月10日的回应说得很直接:美方指控“于事无凭,于法无据”,是将蒸馏这一业内正常的技术和商业问题政治化、工具化,在实践中搞双重标准。
还有一个贝森特选择性忽略的事实:很多美国AI企业在研发和训练中,也蒸馏了中国的模型, 同样一件事,美企做了叫“行业惯例”,中企做了就叫“窃取”。这套逻辑,不用反驳,它自己就站不住。
华盛顿真正焦虑的是什么,7月22日,白宫科技政策办公室主任公开指控中国AI公司“大规模蒸馏美国模型”,贝森特暗示可能对参与蒸馏的中国AI公司实施制裁。
从“封锁芯片”到“定性蒸馏”,节奏变了。
芯片卡着不卖,是想掐死上游供给,但中国走了一条不一样的路:开源生态、工程调优、架构重构,加上庞大的落地场景反哺迭代,硬是把前沿模型的成本门槛往下砸了一截。
OpenRouter平台的数据显示,中国开源模型的使用成本比美国领先模型便宜60%到90%。
算力壁垒的威慑力,在低成本路线面前打了折扣。所以美方的策略从“封锁”转向了“定性”——把商业技术问题包装成道德指控,下一步就可以顺理成章地把API调用、开源权重、跨境云服务塞进管制清单。
英伟达联合微软、Meta、IBM等25家公司和机构签署的公开信说得很清楚:模型蒸馏是AI行业被广泛采用的常规技术手段,不应将其与非法获取闭源模型价值的行为混为一谈。
一个真正处于绝对技术优势地位的玩家,不需要靠舆论战来维持护城河,需要靠“偷窃”这个叙事来维持的,恰恰说明护城河没那么深了。
贝森特这番话,本质上是把技术竞争焦虑包装成了道德指控。
中国开源AI跑得太快,美国现有的叙事框架解释不了,按老剧本,中国应该被算力封锁卡死,但事实是,中国AI企业走了一条“少花钱、多办事”的路,而且这条路正在被全球开发者用脚投票。
黄仁勋说“竞争会让所有事物变得更好”,这话听着温和,但戳破了贝森特的逻辑:如果蒸馏真是“偷窃”,那先解释一下,为什么美国企业自己在用中国模型?
贝森特点名Kimi说“Kimi认为自己是Claude”。但真正的Kimi用户知道,Kimi就是Kimi,至于它像不像Claude,市场已经给出了答案——那些从Claude切换到DeepSeek和Kimi的美国公司,不是因为“偷来的东西好用”,是因为便宜、够用、能跑起来。
