Press "Enter" to skip to content

谷歌面临诉讼,指控其滥用数据来训练其LLM

谷歌面临诉讼,指控其滥用数据来训练其LLM 四海 第1张

在一起新的诉讼中,谷歌面临滥用个人数据的指控,用于训练其支持其人工智能产品的大型语言模型。该诉讼声称,这家科技巨头未经用户同意,擦取数百万用户的数据,违反了版权法在训练其人工智能产品的过程中。

该诉讼还将针对其母公司Alphabet和DeepMind。Clarkson律师事务所上个月对ChatGPT制造商OpenAI提起了类似的诉讼,此次诉讼已在加利福尼亚州联邦法院提起。诉讼声称,谷歌“一直在秘密窃取数以百万计美国人在互联网上创作和共享的一切”。

它还声称,像Bard这样的产品也是用这些数据进行培训的。但是诉讼进一步指称,谷歌“几乎拥有我们的全部数字足迹”,这当然包括“创作和版权作品”以构建其人工智能产品。

在向CNN发表的声明中,谷歌的总法律顾问Halimah DeLaine Prado称诉讼中提出的指控是“毫无根据的”。他继续说:“多年来,我们一直明确表示我们使用来自公共来源的数据——如发布在开放网络和公共数据集上的信息——以负责任的方式和符合我们的人工智能原则来训练Google翻译等服务背后的AI模型。”。

Halimah DeLaine Prado继续指出现行的使用法律先例,“美国法律支持使用公共信息来创建新的有益用途,我们期待驳斥这些毫无根据的指控。”。

关于从全球网络上擦取信息以用于训练AI模型的问题已经酝酿了数月。随着基于人工智能的工具和产品在市场上迅速增长,与版权、隐私等相关的问题已成为讨论负责任人工智能的圈子中日益关注的问题。

Clarkson律师事务所的律师之一Tim Giordano告诉CNN:“谷歌需要明白‘公开可用’从来不意味着可以免费用于任何目的,…我们的个人信息和数据是我们的财产,它们是有价值的,没有人有权利随意拿走并将其用于任何目的。”。

Giordano继续区分了谷歌的搜索索引和其获取数据来训练模型的方式之间的区别。他说,对于索引,谷歌可以“提供指向您作品的属性链接,实际上可以推动某人购买或与之互动。”。另一方面,当涉及擦取时,它是“作品的替代版本,从根本上改变了任何人需要购买该作品的激励。”。

这起诉讼要求谷歌暂时冻结商业访问和商业开发其生成式人工智能工具的权限。如果获得这项禁令,谷歌计划在2023年扩大其人工智能的计划可能会受阻。

此外,该诉讼还要求赔偿索赔人的未指明损害赔偿金,声称他们的数据被该公司滥用。

Leave a Reply

Your email address will not be published. Required fields are marked *