From Silicon Valley to DC, the tech world is suddenly obsessed with one concept in AI: Distillation
CNBC·2026-07-25 20:00

AI蒸馏技术成为行业焦点 - 谷歌人工智能负责人Jeff Dean在年初讨论了一项当时仅在技术圈内被提及的概念:蒸馏技术,该技术旨在通过前沿模型来提升较小模型的性能[1][2] - 五个月后,蒸馏技术已成为从硅谷到华盛顿的热门话题,围绕其是否构成国家安全威胁并帮助中国在AI竞赛中追赶美国展开激烈辩论[3] - 蒸馏技术指利用聊天机器人答案或先进AI模型的工作成果来训练另一个模型,这种做法存在争议,因为它可能使模型开发者仅通过利用其他公司投资数百万或数十亿美元开发的成果,就能创造出有竞争力的产品[7][8] 中美AI竞争与开源模型争议 - 中国实验室月之暗面发布的Kimi K3模型被认为可与Anthropic和OpenAI的最佳商用AI竞争,引发关注[3] - 与美国领先AI公司销售专有模型访问权不同,月之暗面等中国实验室提供所谓的“开源权重”模型,允许用户下载、调整并任意运行该技术[4] - 一些美国政府官员将月之暗面快速追赶的能力归因于蒸馏技术,并将其描述为对美国知识产权(特别是整合了Anthropic的前沿Fable模型)的窃取[4] 行业巨头联合发声与政策困境 - 英伟达、微软、Meta、Palantir等超过20家公司联合发布公开信,敦促政策制定者避免对开源权重AI模型实施“过早限制”,以免扼杀竞争或将创新驱往海外[8] - 这些公司在信中表示,蒸馏是一种广泛用于模型改进、演进和验证的技术[8] - 蒸馏技术的出现给美国政策制定者带来了难题,他们长期担忧中国在知识产权盗窃和国家安全方面的问题[9] 主要AI公司的立场与行动 - Anthropic公司表示,其Claude模型的能力正被中国的深度求索、月之暗面和MiniMax以“工业规模”进行蒸馏,后者使用了约24,000个虚假账户,生成了1,600万次交互[13] - Anthropic公司估值接近1万亿美元,并有意在不久的将来上市,其认为阻止非法蒸馏是一个国家安全问题[14] - OpenAI和Anthropic已在其服务条款中禁止蒸馏行为,这实质上是在暗示未经授权使用其大型模型可能构成潜在的知识产权盗窃[16] 技术应用与成本考量 - 英伟达在其Llama Nemotron系列模型的训练过程中使用了蒸馏技术[12] - 研究总监Shashi Bellamkonda指出,在大型模型输出上训练更小、更便宜的模型是一种合法且非常有价值的技术,并且一直在实践中[12][13] - 随着AI成本飙升,公司将采取一切措施来提高效率,例如安全评估AI公司SecurityPal的创始人表示,使用像Kimi K3这样的中国开源模型可以节省大量资金[16] 知识产权争议的双重标准 - Anthropic和OpenAI在主张其知识产权被盗用时面临一个问题:这两家公司自身也依赖其他内容源来构建其模型,并因此被起诉[17] - 律师Max Pritt指出,美国政府至少在公开场合,将其努力集中于保护科技公司的知识产权,而对创作者和个人未经授权被使用的知识产权在很大程度上保持沉默[18]

From Silicon Valley to DC, the tech world is suddenly obsessed with one concept in AI: Distillation - Reportify