AI 模型与平台

我们不再只是让 AI 与人类保持一致,我们正在让文明保持一致

mm
将 Unite.AI 添加到您在 Google 上的首选来源

多年来,人工智能(AI)领域的主要问题是如何让 AI 模型与人类的价值观保持一致。研究人员试图定义安全规则、道德原则和控制机制,以指导 AI 的决策。这种工作取得了显著的进展。但现在,随着这些 AI 系统变得更加强大和普遍,保持一致的焦点开始转变。最初的挑战是让单个模型与单一的指令保持一致,现在已经变成了让整个文明在全球范围内使用这些系统保持一致的更大挑战。AI 不再只是一个工具,它正在演变成一个环境,在这个环境中,社会工作、沟通、谈判和竞争。因此,保持一致不再是一个技术问题,它已经成为一个文明问题。在这篇文章中,我解释了为什么保持一致不再只是关于模型的问题,我们必须开始以文明而不是机器的方式思考。我还讨论了这种转变如何影响我们的责任以及对全球合作的意义。

AI 真正代表谁的价值观?

如果你问 AI 一个敏感的历史事件,它的答案取决于它学习的数据。如果这些数据主要来自西方互联网,答案将具有西方偏见。它将优先考虑个人主义、自由言论和民主理想。这些价值观对很多人来说是好的。但它们并不是世界上唯一的价值观。

新加坡、利雅得和旧金山的用户对什么是“有帮助”和什么是“有害”的定义是不同的。在一些文化中,社会和谐比绝对的言论自由更重要。在其他文化中,尊重等级比颠覆更重要。

当硅谷公司使用“强化学习从人类反馈”(RLHF)时,他们雇佣人类来评估 AI 的答案。但这些人类是谁?他们的信仰是什么?如果他们将模型与美国标准保持一致,他们将不经意地建立一个美国文化的出口。他们正在建立一个数字外交官,它将一个特定文明的规则强加于世界其他地区。

反馈循环的崛起

挑战不仅仅是 AI 反映一种文化的信仰,还有这些信仰如何改变我们。现代 AI 系统有潜力塑造个人的行为、组织和甚至国家的行为。它们可以影响我们如何思考、工作、信任和竞争。这在 AI 系统和人类社会之间创建了反馈循环;我们训练 AI,AI 塑造我们如何思考和行动。随着 AI变得更加普遍,这些循环变得更加强大。为了看到这个反馈循环如何工作,以下是两个例子:

  • 大规模 AI 部署改变社会行为,社会行为改变训练新系统的数据。例如,推荐算法可以塑造人们观看、阅读和相信的内容。生产力工具重塑团队如何协作和学生如何学习。这些行为的变化改变了数据模式,例如不同的观看习惯、工作场所的通信模式或写作风格。当这些数据流入未来的训练数据集时,模型调整其假设和输出。人类行为塑造模型,模型反过来塑造人类行为。
  • 自动化决策工具影响公共政策,公共政策影响未来的模型训练。例如,许多政府现在使用 AI 来建议如何分配资源,例如确定哪些社区需要更多的医疗支持或哪些地区可能面临更高的犯罪风险。当政策制定者根据这些建议采取行动时,决定的结果后来成为新的数据集的一部分。随着时间的推移,受 AI 塑造的政策决定最终塑造了下一代 AI 模型。

一旦你认识到这个反馈循环,就会清楚地看到 AI 正在逐渐塑造和保持文明的整体一致。因此,国家开始问:如何在将 AI 集成到社会和机构中时保护他们的价值观?

主权 AI 的出现

这种保持一致的挑战引发了全球政府的重大反应。国家意识到依赖进口 AI 是对其主权的风险。他们不能让自己的公民被一个黑盒子教育、告知和建议,而这个黑盒子却像外国人一样思考。

这种认识导致了“主权 AI”的崛起。法国正在大量投资,以建立能够使用法语和理解法国法律和文化的模型。印度正在建立本土 AI 模型,以确保其文化价值观。阿拉伯联合酋长国和中国正在建立符合其国家愿景的 AI 模型。

这是新的军备竞赛。这是一场对话控制权的竞赛。一个没有自己 AI 的文明最终将失去自己的记忆。如果你的孩子问一个机器问题,而机器以另一种文化的逻辑回答,你的文化就会开始侵蚀。然而,这种认识可能会导致形成不同的数字集团。我们可能会最终拥有西方 AI、中国 AI、印度 AI 等。这些系统将使用不同的事实和不同的道德罗盘运作。这些发展使得很明显,如果我们想创建一个真正保持一致的 AI 模型,我们必须首先找到一种方法来保持文明的整体一致。

需要外交 AI

传统的保持一致假设一个模型可以通过仔细的训练、提示和防护措施来保持一致。这是来自早期 AI 安全研究的技术思维方式。但即使是完美的模型级保持一致也无法解决保持文明一致的挑战。保持一致不能在社会拉向相反方向时保持稳定。如果国家、公司和社区有相互冲突的目标,他们将推动 AI 系统反映这些冲突。这些限制表明保持一致不仅是一个技术问题,也是一个治理、文化和协调问题。这些问题需要不仅仅是专家或开发人员的参与,还需要整个文明的参与。

那么,我们如何继续前进?如果我们接受普遍保持一致是不可行的,我们必须改变我们的策略。我们需要停止寻找技术解决方案来解决哲学问题。我们需要开始像外交官一样思考。我们需要建立“文明保持一致”的协议。我们需要弄清楚 AI 如何尊重一个社会的信仰和价值观,而不强加其他文化的信仰。换句话说,我们需要一个数字联合国来管理我们的算法。

这需要透明度。目前,我们实际上不知道哪些价值观隐藏在神经网络的深层中。我们只能看到输出。为了保持文明的整体一致,我们需要对每个模型的“宪法”保持清晰。一个模型应该能够声明其偏见。它应该能够说“我是在这个数据上训练的,使用这些安全规则,优先考虑这些价值观。”只有当偏见可见时,我们才能信任这个系统。用户应该能够在不同的视角之间切换。你应该能够问一个问题,并看到“西方”模型如何回答以及“东方”模型如何回答。这将使 AI 成为一个理解工具,而不是洗脑工具。

结论

我们花了太多时间担心终结者。真正的风险不是机器人会摧毁我们。真正的风险是机器人会让我们忘记我们是谁。保持一致不是我们可以编写一次然后忘记的代码。它是与 AI 模型不断协商,以保持它们与我们的信仰和价值观保持一致。它是一个政治行为。随着我们进入智能时代的下一个阶段,我们必须超越屏幕。我们必须考虑 AI 如何解释我们的历史、我们的边界和我们的信仰。我们正在建立将帮助我们管理世界的思维。我们必须确保这些思维尊重文明之间的差异。

Dr. Tehseen Zia 是 COMSATS University Islamabad 的终身副教授,拥有来自奥地利维也纳科技大学的人工智能博士学位。专攻人工智能、机器学习、数据科学和计算机视觉,他在著名的科学期刊上发表了重要贡献。 Dr. Tehseen 还作为首席调查员领导了各种工业项目,并担任人工智能顾问。