伦理

谷歌透露使用公共网络数据进行 AI 训练

mm
将 Unite.AI 添加到您在 Google 上的首选来源

谷歌最近更新了其隐私政策,公开承认使用公开的网络信息来训练其 AI 模型。这种披露由 Gizmodo 发现,包括 Bard 和 Cloud AI 等服务。谷歌发言人 Christa Muldoon 对 The Verge 表示,这次更新只是澄清了像 Bard 这样的新服务也包括在这种做法中,并且谷歌在开发其 AI 技术时会融入隐私原则和保障措施。

AI 训练实践的透明度是一个积极的步骤,但也引发了许多问题。谷歌如何确保在使用公开数据时保护个人的隐私?有什么措施可以防止这种数据被滥用?

谷歌 AI 训练方法的影响

更新后的隐私政策现在指出,谷歌使用信息来改进其服务,并开发新的产品、功能和技术,以造福其用户和公众。该政策还规定,公司可能会使用公开的信息来训练谷歌的 AI 模型,并构建像谷歌翻译、Bard 和 Cloud AI 能力的产品和功能。

然而,该政策并没有阐明谷歌将如何防止版权材料被包含在用于训练的数据池中。许多公开的网站都有政策,禁止出于训练大型语言模型和其他 AI 工具的目的而收集数据或进行网页抓取。这可能会与像 GDPR 这样的全球法规相冲突,后者保护人们免受未经许可滥用其数据的侵害。

使用公开的数据进行 AI 训练本身并不是问题,但当它侵犯版权法和个人隐私时,就会变得有问题。这是一个需要像谷歌这样的公司谨慎处理的微妙平衡。

AI 训练实践的更广泛影响

使用公开的数据进行 AI 训练一直是一个有争议的问题。像 OpenAI 的 GPT-4 这样的流行生成式 AI 系统一直对其数据来源保持沉默,包括是否包含社交媒体帖子或人类艺术家和作者的版权作品。这种做法目前处于法律灰色地带,引发了多起诉讼,并促使一些国家的立法者提出更严格的法律来规范 AI 公司如何收集和使用其训练数据。

美国最大的报纸出版商 Gannett 正在起诉谷歌及其母公司 Alphabet (GOOG ) (GOOGL ) ,声称 AI 技术的进步帮助谷歌在数字广告市场占据主导地位。同时,社交平台如 Twitter 和 Reddit 已采取措施防止其他公司自由收集其数据,这导致了各自社区的反弹。

这些发展凸显了 AI 领域需要健全的道德指南。随着 AI 的不断发展,公司必须在技术进步和道德考虑之间取得平衡。这包括尊重版权法,保护个人隐私,并确保 AI 为整个社会带来益处,而不仅仅是少数人。

谷歌最近更新其隐私政策,揭露了公司的 AI 训练实践。然而,这也引发了人们对使用公开数据进行 AI 训练的伦理影响、潜在的版权法侵犯以及对用户隐私的影响的疑问。随着我们向前迈进,继续这一对话并朝着负责任地开发和使用 AI 的未来努力是至关重要的。

Alex McFarland 是一名人工智能记者和作家,探索最新的人工智能发展。他曾与世界各地的众多人工智能初创公司和出版物合作。