中国真的在窃取美国公司的人工智能技术吗? - 纽约时报中文网
High confidence: full text extraction produced 1248 characters.
在外界对AI潜在风险的担忧日益加剧之际,两国领导人预计将就该技术的快速崛起展开讨论;与此同时,众多美国官员、科技高管及普通民众纷纷呼吁放慢发展步伐。虽然Anthropic和OpenAI等美国企业在AI竞赛中处于领先地位,但以智谱和月之暗面为代表的中国初创企业同样紧追不舍。
双方会谈中最具争议的议题之一是硅谷反复提及的指控——即中国公司正利用一种叫做“蒸馏”的技术挪用美国领先的AI技术。
许多专家指出,Anthropic与OpenAI等公司的上述说法有夸大之嫌。销售中国技术接口服务的美国公司Baseten模型训练负责人查尔斯·奥尼尔表示:“‘中国技术的全部能力均源自Anthropic模型’这种说法远非人们所传的那样属实。”
广告
本文意在解释一个不为大众所知的技术流程是如何成为一个地缘政治问题的。
什么是蒸馏?
如今各家企业依然在沿用这种蒸馏手段。但近年来,该技术也演变成了企业从他人构建的技术中收集数据的一种途径。
简而言之,意图蒸馏竞争对手系统的外部公司会在对方的服务(如Anthropic的Claude或OpenAI的GPT)上注册大量账户,随后将这些系统指定用于特定的任务,例如计算机编程或数学运算。
广告
蒸馏方随后即可利用这些成熟AI系统生成的信息辅助训练自身的全新系统。
蒸馏是否违法?
部分法律学者指出,蒸馏行为可能违反《保护商业秘密法》,企业可以依据该法就商业秘密盗窃行为提起诉讼。不过,美国法院尚未对这一问题作出明确裁决。
版权法并不一定适用于此类情况,因为蒸馏旨在复制系统的总体行为逻辑,而非逐字逐句地抄袭其文本。
Anthropic和OpenAI的批评者指出,这两家公司自身也有类似行为。
广告
广告
仅凭蒸馏是否足以解释中国大模型何以保持竞争力?
答案是否定的。当企业对专有系统进行蒸馏时,它们所能获取的仅限于系统生成的数据(如词语、字符等输出内容),而无法像对待开源技术那样,接触到系统底层的源代码。
利用Anthropic的Claude Fable等专有系统的输出内容,中国企业确实可以加速自身技术的开发进程,但这些输出仅仅是整个技术图景的一部分。
追踪最新AI研究的硅谷初创公司alphaXiv联合创始人里汉·阿赫迈德指出:“你在内部蒸馏自家模型时能用到的底层要素,通过这种外部方式是根本无法获取的。”
在利用这些输出内容之前,中国企业必须首先自主构建出一个本身就具备相当实力的系统。随后,企业虽可通过蒸馏在关键维度打磨模型,但这依然需要投入更多的精力、资金、算力以及人才。
Anthropic与OpenAI能否阻止其他公司实施蒸馏?
广告
它们可以采取手段遏制这种做法,且事实上也有过尝试。
一旦Anthropic或OpenAI怀疑有人在蒸馏其系统,可能会封禁违规者的账户。然而,新的违规账户很可能会接踵而至;而如果封锁过于频繁,两家公司最终可能会误伤合法用户。
另一位alphaXiv研究员利诺·勒万表示:“想要彻底杜绝蒸馏,在现实中几乎是不可能的。”