思想领袖

谁将保护我们免受AI生成的虚假信息的侵害?

mm
将 Unite.AI 添加到您在 Google 上的首选来源

生成式AI仅在一年内就从零发展到百。虽然它还处于初期阶段,但它已经展示了其在商业领域的变革潜力。我们都同意这一点。我们意见分歧的地方在于如何遏制它带来的危险。

为了澄清,我是创新派,并不恐惧未来。但最近虚假信息的激增,主要针对当前的争议话题,这使得很明显,如果不加以控制,生成式AI可能会对社会造成毁灭性的影响。

我们以前在社交媒体上见过这种情况,但那时需要几年时间和艰难的教训,才能使我们意识到其缺陷。我们已经(假设)学到了些什么。今天的问题是,谁将帮助遏制生成式AI带来的现实扭曲潮流,以及如何做到这一点?

可以预见,政府开始采取行动。欧洲正在引领这场运动,就像他们在科技监管方面所做的那样。美国紧随其后,拜登总统于去年十月份颁布了一项行政命令。

但这需要全球村庄共同努力,才能“让生成式AI保持诚实”。在政府能够提供帮助之前,它需要了解现有方法的局限性。

身份问题变得更加严重

在这个新世界中,真相就像一根针,隐藏在一堆伪装成事实的意见中。知道内容来自哪里,变得比以往任何时候都更加重要。

而且,这不像是在社交媒体账户上强制实施身份验证那么简单。有很多人反对这一做法,在某些情况下,匿名是为了保护账户持有人的正当权利。此外,很多人在消费最糟糕的内容时,并不关心其可信度或来源。

尽管有这些顾虑,身份在应对生成式AI方面的潜在作用被低估了。怀疑者,请听我说。

让我们想象一下,监管或社会良知促使平台为每个账户持有者提供以下选择:

  1. 验证他们的身份或不验证,
  2. 公开显示他们的验证身份,或仅标记为“已验证”

那么,社交媒体观众就可以更好地决定谁是可信的。同样重要的是,身份支持问责。平台可以决定对反复发布AI生成内容的“虚假信息者”和滥用者采取行动,即使他们使用不同的账户名称。

随着生成式AI提高了赌注,我相信身份——知道谁发布了什么——是至关重要的。有些人会反对它,身份并不是一个全面答案。事实上,没有任何解决方案能够满足所有利益相关者。但如果监管要求平台为所有账户提供身份验证,我相信这将带来巨大的积极影响。

内容审查困境

内容审查——无论是自动还是人工——都是抵御不良内容的最后防线。人工审查是一份艰难的工作,审查员可能会因接触到最糟糕的内容而受到心理伤害。它也很昂贵,经常被指责为有偏见的审查,这是平台试图减少的。

自动审查可以超越人类的能力,应对内容的洪流,但它无法理解上下文(例如表情包),也无法理解文化细微差别。两种审查形式都很重要,都是必要的,但它们只是答案的一部分。

通常听到的、传统的解决方案是:“需要科技领袖、政府和民间社会之间的合作。”当然,但具体来说是什么?

政府可以促使社交媒体和媒体平台提供身份验证,并在所有帖子中显著显示。监管机构还可以为可信度指标铺平道路,这些指标可以真正帮助判断一个来源是否可信。合作对于制定普遍标准至关重要,这样私营部门就不必猜测。

最后,创建恶意AI输出是否应该是违法的?禁止用于非法活动的内容可能会减少有害内容的数量,并减轻审查员的负担。我不认为监管和法律能够彻底消除虚假信息,但它们在应对这一威胁方面是必不可少的。

乐观的创新

创新带来的希望使我保持乐观。我们不能指望政客或平台所有者完全保护我们免受AI生成的欺骗。他们留下了一个巨大的空白,这正是将激发新技术的发明,以验证内容和检测欺骗。

既然我们已经知道社交媒体的缺点,我们很快意识到生成式AI可能会成为人类的净负面,其能够使人偏执和误导他人。

乐观地看,我认为多方面的方法是有效的,控制方法可以协同工作。首先,在源头限制非法使用的内容创建。然后,在发布之前,验证那些拒绝匿名的人的身份。接下来,明确标记可信度评级和发布者身份或匿名状态。最后,自动和人工审查可以过滤掉一些最糟糕的内容。我预计很快就会有新的身份验证技术问世。

总的来说,我们将拥有一个更好的,尽管不完美的解决方案。与此同时,我们应该提高自己的技能,来判断什么是真实的,谁在说真话,谁试图欺骗我们。人类审查可以过滤掉一些最糟糕的内容。我预计很快就会有新的身份验证技术问世。加上这一切,我们将拥有一个更好的,尽管不完美的解决方案。与此同时,我们应该提高自己的技能,来判断什么是真实的,谁在说真话,谁试图欺骗我们。

杰夫·萨卡塞加瓦(Jeff Sakasegawa)是 Persona 的信任与安全架构师。在信任与安全领域拥有十多年的经验,曾在 Google、Facebook、Square 和 Sift 等公司工作,杰夫是风险管理和合规方面的专家。他热衷于确保所有用户都能拥有安全的在线体验。