谷歌AI负责人杰夫·迪恩讨论AI蒸馏技术后,英伟达、微软等20余家公司联名敦促政策制定者避免对开放权重AI模型实施过早限制,Anthropic和OpenAI则禁止蒸馏
本文是 24TopNews 对公开财经信息完成重复合并后的事件分析,不是原始采访或证券推荐。
今年早些时候,谷歌AI负责人杰夫·迪恩在一个播客中讨论了AI蒸馏技术。他表示,谷歌在开发AI模型时发现了这一技术,目的是在不依赖单一大型图像识别模型的情况下提升系统性能。迪恩在二月份指出,蒸馏是让较小模型能力更强的关键技术,必须先有前沿模型,才能将其蒸馏进较小模型中。
五个月后,蒸馏成为从硅谷到华盛顿的热门话题。蒸馏指的是利用聊天机器人的答案或先进AI模型的产出成果来训练另一个模型。这种做法存在争议,因为根据使用方式的不同,它可以让模型开发者仅通过使用那些投资了数百万或数十亿美元开发训练技术的公司的产出,就能创建出具有竞争力的产品。
全球多家科技巨头于周五联合发布了一封联名信,敦促政策制定者避免对开放权重AI模型实施“过早限制”。签署方包括英伟达、微软、Meta、Palantir等20多家公司。联名信指出,蒸馏是用于模型改进、演进和验证的广泛使用的技术,即使用一个模型的输出来帮助训练或改进另一个模型。
Box公司首席执行官亚伦·列维是联名信的签署人之一。他表示,为了保持竞争力,美国公司需要能够获取最好的技术,无论它是在哪里开发的。列维认为,总体趋势是创新越多,AI进步越多,并会朝着成本更低、效率更高的方向发展。
Info-Tech研究集团的研究总监沙希·贝拉姆孔达表示,许多公司在创建自己的模型时纳入了蒸馏技术。例如,英伟达在其Llama Nemotron系列模型的训练过程中就使用了蒸馏,相关研究论文中有详细描述。
Anthropic持有不同观点。该公司表示,阻止非法蒸馏事关国家安全。Anthropic在二月份的帖子中称,其构建了系统以防止国家和非国家行为者利用AI,例如开发生物武器或进行恶意网络活动,阻止它需要行业参与者、政策制定者和全球AI社区之间迅速、协调的行动。
OpenAI和Anthropic在其服务条款中禁止蒸馏。贝拉姆孔达表示,它们实质上是在暗示,未经授权使用它们的大型模型代表了潜在的知识产权盗窃。随着AI成本飙升,公司将竭尽全力提高效率。
SecurityPal公司创始人普卡尔·哈马尔表示,该公司使用AI自动化安全评估,不反对使用开放权重模型。他说这可以节省大量资金,在完成评估后将其托管在自己基础设施上。
Anthropic和OpenAI在论证知识产权盗窃问题时面临的一个问题是,这两家公司都依赖其他的内容来构建自己的模型,并因此被起诉。Boies Schiller Flexner律师事务所的律师马克斯·普里特,在针对AI公司的版权诉讼中代表书籍作者。他表示,政府也处于同样的境地,至少公开地,本届政府将其工作重点放在保护科技公司的知识产权上,而对创作者和个人的知识产权在未经授权的情况下被使用保持沉默。