AIモデルとプラットフォーム

Facebook、1.5億のReddit投稿を使用してトレーニングされたオープンドメインチャットボット「Blender」を作成

mm
Unite.AI を Google の優先ソースに追加

Facebookは最近、オープンドメインチャットボット「Blender」を発表しました。 BBCの報道によると、FacebookのBlenderは同社がこれまでに開発した最大のオープンドメインチャットボットであり、同社によると、Blenderは共感、個性、知識を示し、他のチャットボットよりも人間に近い感覚を与えます。 Blenderは使用可能で、3つの異なるバリアントがあり、それぞれが異なるレベルの複雑さとモデル精度を持っています。 9,000万パラメータのニューラルモデル、27億パラメータのモデル、94億パラメータのモデルがあります。 94億パラメータのモデルは、現在存在する最大のチャットボットよりも約3.6倍大きいです。

Facebookによると、Blenderは、知識や共感などの複雑で多様な会話スキルを組み合わせた最初の広く利用可能なチャットボットです。 Blenderチャットボットは、さまざまなトピックについて議論し、最大14回の会話「ターン」を実行できます。 報道によると、チャットボットとやり取りした人の約49%が、別の人ではなくボットとやり取りすることを好みました。

Blenderは、Redditなどのソーシャルメディアサイトから収集されたパブリックドメイン会話データを使用してトレーニングされました。 Blenderをトレーニングするために使用されたデータセットには、約15億の会話例が含まれていました。 トレーニングデータとモデルの精度により、チャットボットは複雑な議論を行い、より自然で人間らしい雰囲気を醸し出しますが、このトレーニング方法により、いくつかの問題が生じました。 研究者によると、Blenderは時々会話のプロンプトに攻撃的または不快な言語で応答したり、嘘やでっち上げられた事実で応答したりしました。 研究チームは、モデルを改良することでこれらの問題に対処できると考えていますが、モデルを公開したいと考えました。

Facebookのスポークスパーソンによると、BBCの引用によると、「モデルを公開することは、機能についての完全で信頼できる洞察を得るために不可欠です」。

Facebookの研究者は、人工知能コンサルタント会社The EnvisionersのCEOであるDave Choplinによると、2つの大きな課題を克服する必要があります。 Choplinは、研究者が人間の会話の多くのニュアンスを再現することと、モデルをトレーニングするために使用されるデータがモデルを妨げる可能性があることを示唆しています。

「Redditは素晴らしいプラットフォームですが、そこでの会話に基づいてアルゴリズムをトレーニングすることは、ごみの中に宝石を見つけるようなものです」とChoplinは述べた

Facebookは、自身のBlenderチャットボットとGoogleのMeenaチャットボットを比較しました。 Facebookのブログ投稿では、MeenaとBlenderの比較が示されており、Facebookのデータによると、Blenderと会話した約75%の回答者が、MeenaよりもBlenderと長い会話をしたいと答えました。 さらに、約67%の回答者が、長い会話についてBlenderはMeenaよりも自然で人間に近いと答えました。

将来的に、Facebookの研究チームは、会話の能力を向上させることを目指しており、新しい損失関数とアーキテクチャを使用して、より長い会話をサポートできるモデルを設計しています。 さらに、研究者は、ジェンダーバイアスや有害な言語に対処するために、より優れた分類器とより代表的なトレーニングデータを構築することを目指しています。

ブログ作家およびプログラマーで、 Machine Learning Deep Learning のトピックを専門としています。Danielは、AIの力を社会のために利用する手助けを他者に与えることを希望しています。