最近这两年,来自Anthropic、OpenAI和谷歌等企业的指控声浪不断高涨——他们纷纷声称中国科技企业在不正当地使用其AI技术。而这一争议也恰好成为本周习主席访美与特朗普进行会晤的议题之一。
伴随着公众对AI风险的忧虑与日俱增,这场讨论也涵盖了该技术的迅速发展趋势。值得注意的是,不少美国政界人士、业界精英乃至普通民众都在呼吁减缓开发节奏。尽管美国的Anthropic和OpenAI等公司目前领跑全球AI竞争,但包括智谱和月之暗面在内的中国新兴企业也不甘落后,快速追赶。
在这场对话中,硅谷企业频频提起的一项指控尤为引人瞩目——声称中国企业借助「蒸馏」技术对美方先进的AI系统进行了非法复制。
不过,业界专家对这些指控持有保留态度,认为其中存在夸大成分。美国公司Baseten的模型训练主管查尔斯·奥尼尔直言:”将中国技术的全部实力都归咎于Anthropic的说法,根本站不住脚。”
接下来的篇幅里,我们会深入探讨这一鲜为人知的技术现象如何演变成了当今的地缘政治焦点。
这项技术究竟是什么?
蒸馏这一方法诞生于2010年代初期,最初是研究人员为了开发性能更优、效率更高的AI系统而创造的手段。其工作原理是:研究人员从已有的成熟系统中获取信息,然后将其用于训练新的系统,使新系统可以在配置更低廉的硬件上高效运行。
参与该技术研发的谷歌资深研究员杰弗里·辛顿曾在接受采访时用了一个比喻:”想象一个模型充当教师的角色,而另一个则是学生。”
当下,企业界仍在广泛应用蒸馏手法,但随着时间推移,这项技术被一些公司挪作他用,成为了从竞争对手的系统中抽取数据的工具。
具体来说,如果某家企业想要蒸馏对手的专有系统,他们会在目标服务(比如Anthropic的Claude或OpenAI的GPT)上创建众多账户,然后用这些账户去提出各种任务指令,涉及编程、数学等多个领域。通过这个过程收集到的数据和输出结果,蒸馏方就可以用来帮助自己训练一套新的AI系统。
这类行为是否触犯法律?
一些法律专家认为,蒸馏可能构成对《保护商业秘密法》的违反,相关企业据此可对商业秘密的被盗窃提起诉讼。然而,美国司法部门至今还没有就此给出明确的法律判决。
值得注意的是,著作权法在这里可能不太适用,因为蒸馏的目标是复制系统的工作原理和功能特性,而不是直接照搬其内容。
然而,有评论人士指出,Anthropic和OpenAI本身也曾从事过类似的做法。
Anthropic因被指控在未获授权的情况下利用有版权保护的网络数据进行系统训练而面临诉讼。去年,法院判定该公司非法获取并保存了数以百万计的有版权的书籍内容后,Anthropic与一批作家和出版单位达成了一份历史性的和解协议,同意赔付15亿美元。这笔赔款金额创造了美国版权诉讼案件中的新高。
OpenAI和其他科技企业同样陷入类似的法律争议,其中《纽约时报》在2023年的起诉案最为瞩目。控方声称OpenAI与其合作者微软采用了时报刊登的大量文章来训练各自的对话AI,而这些AI现已成为传统新闻机构的信息竞争者。对于这些指控,OpenAI和微软均表示否认。
中国企业是否真的在这样做?
尽管中国的科技企业很可能对美国专有系统进行了蒸馏操作,但具体如何操作的细节仍不清楚。
去年,中国创业公司DeepSeek推出的高效能AI系统在美国研究界和投资圈引起了轰动,随后OpenAI公然指控其蒸馏了自家技术。在过去的大约九个月里,中国企业的AI系统能力不断增强,Anthropic也因此提出了蒸馏指控。6月间,Anthropic向美国参议员蒂姆·斯科特和伊丽莎白·沃伦写信,声称中国科技龙头阿里巴巴进行了蒸馏。而被点名的中国公司对这些指控一直保持沉默。
仅凭这种手段,能否解释中国AI的竞争力?
答案是没有。蒸馏行为只能让企业获得系统的输出结果(例如生成的文字或其他形式的数据),但无法像操作开源项目那样深入到系统内核和源代码层面。
虽然对Claude等专有系统的输出加以利用,中国公司的确能够快速推进自己的技术进展,但这些输出结果只是完整技术体系的冰山一角。
专门研究最新AI动向的硅谷新创企业alphaXiv的共同创始人里汉·阿赫迈德道出了要点:”那些在内部优化自家模型时可以使用的深层次要素,从外部蒸馏的方式中根本得不到。”
要想有效利用这些被蒸馏的输出,中国公司必须先自己打造一套具有相当水平的基础系统。之后,虽然他们能通过蒸馏在某些关键方面优化模型,但仍然要付出大量的努力、资金、计算资源和人才。
两家美企能阻止蒸馏吗?
在原则上,这两家公司确实可以采用相关措施来阻止蒸馏行为,实际上他们也曾这样做过。
当Anthropic或OpenAI察觉到蒸馏迹象时,他们通常会禁用涉事账户。但问题在于,违规者可以轻易创建新账户继续进行;过度的账户禁用又可能波及无辜的正常用户。
alphaXiv的另一位研究人员利诺·勒万坦言:”从技术角度讲,完全消除蒸馏行为几乎不可行。”