路透社(7月27日)报道:“中方表示,如果美方以中国企业通过蒸馏技术复制美国人工智能模型为由对中国AI企业实施制裁,中方将采取反制措施。中方称相关指控毫无根据,属于‘AI霸权主义’;并指出模型蒸馏是行业通用技术,呼吁开展人工智能领域合作,而非实施制裁。此前美方指责中国企业利用OpenAI与Anthropic的模型加速自研AI产品的开发,由此引发了这场争端。”
评几句
模型蒸馏是什么?简单说,就是让小模型向大模型"学习"知识,这是业界通行多年的基础技术,OpenAI自己也没少用。把它包装成"盗窃知识产权"的罪名,好比指责厨师用了"炒"这个技法。技术本身无罪,有罪的是谁在用、怎么用。美方选择性执法,恰恰说明指控的工具性远大于正当性。
为什么是现在?因为中国AI正在突破"跟跑"阶段。DeepSeek、阿里通义、百度文心等模型在部分基准测试中已经比肩甚至超越美国顶尖水平。当技术差距缩小,"卡脖子"从芯片延伸到算法层面,美方急需新的叙事来维持技术优越感。"蒸馏指控" conveniently( conveniently 地)提供了一个道德高地——我不是打压竞争对手,我是在"保护创新"。
如果蒸馏真能让后来者轻松复制先进模型,那OpenAI耗费数百亿美元训练GPT-4的意义何在?事实是,蒸馏只是辅助手段,核心突破靠的是自主架构创新和算力工程优化。美方一方面夸大蒸馏的威胁性,另一方面又贬低中国AI的原创能力,这种"薛定谔的中国AI"叙事,本身就自相矛盾。
美方试图将"美国模型神圣不可侵犯"写入国际潜规则,本质是技术殖民主义的变种——我定义什么是"合法学习",什么是"窃取知识"。一旦这个先例成立,任何后发国家的技术追赶都可能被扣上"不当获取"的帽子。
