AIモデルとプラットフォーム

研究者はオンラインでのヘイトスピーチに対抗するために人工知能を訓練し始めた

mm
Unite.AI を Google の優先ソースに追加

フェイクニュースやオンラインでのヘイトスピーチは、1分ごとに発生する問題になっています。IkigaiLabによると、FacebookとTwitterは最近、フェイクニュースとヘイトスピーチの拡散を抑えるために、1.5億以上と7000万以上のアカウントを閉鎖しました。 (META )

しかし、現在、人間の力とほぼ常時作業時間が必要です。ヘイトスピーチの氷山の一角を取り除くために、研究者たちは人工知能(AI)を訓練し始めています。

Ikigaiは、Facebookが使用しているRosettaシステムを引用しています。Rosettaは、投稿されたニュース、画像、またはその他のコンテンツの真実性を理解するために使用されます。システムは、投稿されたコンテンツの「単語、画像、言語、フォント、投稿日などをスキャンし、情報が本物かどうかを判断しようとします。」 AIはまだ「ほのめかし、参照、軽蔑、投稿されたコンテキストを完全に理解するには不十分」なので、人間のモデレーターがシステムを導き、ヘイトスピーチとフェイクニュースを発見するのを支援します。

ヘイトスピーチのすべての可能なニュアンスをカバーするために、AIシステムの能力をさらに開発しようと、UCサンタバーバラとインテルの研究者チームは、TheNextWeb(TNW)によると、「RedditとGabの最も汚いコミュニティからの数千の会話を使用して、ヘイトスピーチに対抗するためにAIを開発および訓練しました。」 (INTC )

彼らの報告書によると、共同研究者グループは、ヘイトスピーチで「いっぱいになる」ように特別にキュレーションされた数千の会話を特集したデータセットを作成しました。彼らはまた、Justin Caffier of Voxによってコンパイルされた、ヘイトスピーチで特徴づけられるRedditのグループのリストを使用しました。

研究者たちは、Redditから22,000以上のコメントと、Gabから33,000以上のコメントを収集しました。彼らは、2つのサイトが「似たような人気のヘイトキーワードを持っている」が、「分布は非常に異なる」と発見しました。

彼らは、これらの違いにより、ヘイトスピーチの流れが非常に高いため、社会メディアが介入するのが非常に難しいと指摘しました。

この問題に対処するために、研究チームはAIを介入するように訓練し始めました。彼らの初期データベースは、Amazon (AMZN ) Turkのワーカーにラベル付けされるために送信されました。ヘイトスピーチの個々のインスタンスを特定した後、ワーカーは、AIが「ユーザーが将来同様のヘイトスピーチを投稿しないように」使用するフレーズを作成しました。

その後、チームは「このデータセットと介入のデータベースをさまざまな機械学習と自然言語処理システムを通じて実行し、オンラインヘイトスピーチ介入AIのプロトタイプを作成しました。」

結果は優れましたが、開発はまだ初期段階であるため、システムはまだ活用できません。説明によると、「システムは理論的にはヘイトスピーチを検出して、投稿者にヘイトスピーチを投稿しないように通知するはずです。これは、単にキーワード検出以上のもので、AIはコンテキストを正しく理解する必要があります。」

元外交官およびUNの翻訳者、現在フリーランスのジャーナリスト/ライター/リサーチャーとして、モダンテクノロジー、人工知能、およびモダンカルチャーに焦点を当てている。