AI 模型与平台

Facebook 创建了基于 15 亿 Reddit帖子的自然语音开放领域聊天机器人

mm
将 Unite.AI 添加到您在 Google 上的首选来源

Facebook最近推出了一个开放领域聊天机器人,名为“Blender”。 据BBC报道,Facebook的Blender是其最大的开放领域聊天机器人,据公司称,它能够表现出同情心、个性和知识,超越其他聊天机器人,感觉更像人类。 Blender有三种不同的变体,每种都有不同的复杂性和模型复杂度。 有一个9,000万参数的神经网络模型,一个27亿参数的模型和一个94亿参数的模型。 94亿参数的模型大约是目前最大的聊天机器人的3.6倍。

Facebook声称Blender是第一个将复杂、多样化的对话技能如知识和同情心结合在一起的广泛可用的聊天机器人。 Blender聊天机器人能够讨论各种话题,并进行最多14个对话“转折”。 据报道,大约49%与聊天机器人互动的人更喜欢与机器人交互,而不是与其他人交互。

Blender使用来自Reddit等社交媒体网站的公共领域对话数据进行训练。 用于训练Blender的数据集包括大约15亿个对话示例。 虽然训练数据和模型的复杂性使聊天机器人能够进行复杂的讨论,并具有更自然、更像人类的感觉,但也出现了一些问题。 据研究人员称,Blender有时会用激进的语言或冒犯性语言来响应对话提示。 此外,聊天机器人有时会用虚假信息和编造的事实来响应。 研究团队希望模型的修订将解决这些问题,但他们仍然希望发布模型。

根据Facebook的一位发言人的说法,发布模型对于使其功能具有完整性和可靠性是必要的。

Facebook的研究人员仍然需要克服两个主要挑战才能成功,人工智能咨询公司The Envisioners的首席执行官Dave Choplin如是说。 正如BBC所报道的,Choplin认为研究人员将面临在对话中复制人类常常认为理所当然的细微差别的重大挑战,并且用于训练模型的数据可能会以Facebook的研究人员难以克服的方式限制它。

“Reddit是一个很好的平台,但如果你在那里训练算法,会得到很多无用的信息,”Choplin说

Facebook将自己的Blender聊天机器人与Google的Meena聊天机器人进行了比较。 Facebook的博客文章显示了Meena和Blender之间的比较,根据Facebook的数据,大约75%的与Blender交谈过的受访者更愿意与Blender进行更长时间的交谈,而不是Meena。 此外,大约67%的受访者表示Blender在长时间的对话中比Meena更自然、更像人类。

在未来,Facebook的研究团队希望通过设计能够支持更长时间对话的模型,使用新的损失函数和架构来改进模型的对话能力。 此外,研究人员旨在通过构建更好的分类器和更具代表性的训练数据来处理性别偏见和潜在的有害语言。

博客作者和程序员,专攻 Machine Learning Deep Learning 领域。Daniel 希望帮助他人利用 AI 的力量为社会做好事。