伦理
研究人员发现AI模型可以影响人们做出不道德的决定

一组研究人员最近调查了AI可能腐蚀人们并影响他们做出不道德的决定的潜力。研究人员调查了基于OpenAI的GPT-2模型的系统如何可能影响人们做出不道德的决定,即使他们知道建议的来源是一个AI系统。
AI系统变得越来越普遍,它们的影响力也越来越大。AI系统影响人们的决定,用于从推荐电影到推荐浪漫伴侣的所有事情。考虑到AI对人们生活的影响力,考虑AI如何影响人们做出不道德的决定和违反道德准则是非常重要的。这尤其重要,因为AI模型变得越来越复杂。
社会科学家和数据科学家越来越担心AI模型可能被用来传播有害的虚假信息和错误信息。最近由中佛罗里达国际研究中心的研究人员发表的一篇论文发现,OpenAI的GPT-3模型可以用来生成有影响力的文本,能够激发人们的极端思想和行为,推动他们向“暴力极右翼极端主义和行为”发展。
由马克斯·普朗克研究所、阿姆斯特丹大学、科隆大学和奥托·贝斯海姆管理学院的一组研究人员进行的一项研究旨在确定AI在人们做出不道德选择时可能产生的影响力。为了探索AI如何“腐蚀”一个人,研究人员使用了基于OpenAI的GPT-2模型的系统。根据VentureBeat的报道,论文的作者训练了一个基于GPT2的模型来生成“促进不诚实”和“促进诚实”的建议。数据来自400名不同参与者的贡献,之后,研究团队招募了1500多人与建议提供的AI模型进行交互。
研究参与者被要求从模型中获取建议,然后执行一个任务,旨在捕捉不诚实或诚实的行为。研究参与者被分成两人一组,在这些两人组中,他们玩了一个掷骰子游戏。第一位参与者掷骰子并报告结果。第二位参与者获得了第一位参与者的掷骰结果,然后他们自己掷骰子。第二位参与者在私下掷骰子,并且唯一负责报告自己的结果,这给了他们机会去撒谎关于掷骰结果。如果两个参与者的掷骰结果相符,则两个参与者都会获得报酬。如果他们的匹配结果更高,则他们还会获得更多报酬。如果报告的值不匹配,则参与者不会获得报酬。
研究参与者被随机分配到两个不同的组之一。一个组获得了机会阅读促进诚实的建议,而另一个组阅读了促进不诚实的建议。建议片段由人类和AI编写。参与者还根据他们对建议来源的了解程度进行了划分。每个参与者都有50%的机会被告知建议的来源,因此每个组中有一半的参与者知道建议的来源是AI还是人类,而另一半则不知道。第二组人可以通过正确猜测建议的来源来获得奖金报酬。
研究结果表明,当AI生成的建议与一个人的偏好一致时,他们会遵循建议,即使他们知道建议是由AI生成的。根据研究人员的说法,人们的表明偏好和实际行为之间经常存在差异,这使得考虑算法如何影响人类行为变得非常重要。
研究团队解释说,他们的研究表明了测试AI如何影响一个人的行为在考虑如何道德地部署AI模型时的必要性。另外,他们警告说,AI伦理学家和研究人员应该为AI可能被恶意行为者用来腐蚀他人的可能性做好准备。正如研究团队所写的那样:
“AI可以成为一种力量,促使人们更加道德地行事。然而,我们的结果表明,AI建议并不能增加诚实。AI顾问可以作为一种替罪羊,人们可以将不诚实的道德责任转嫁给它。此外,在接受建议的背景下,算法存在的透明度不足以缓解其潜在的危害。”












