Modele i platformy AI
Badacze zaczynają szkolić sztuczną inteligencję, aby zwalczać mowę nienawiści w sieci
Fałszywe wiadomości i mowa nienawiści w sieci stają się nie tylko codziennym, ale nawet co-minutowym problemem. Jak podaje IkigaiLab, Facebook (META ) i Twitter musiały niedawno zamknąć ponad 1,5 miliarda i 70 milionów kont odpowiednio, aby próbować ograniczyć rozprzestrzenianie się fałszywych wiadomości i mowy nienawiści na całym świecie.
Jednak nadal takie zadanie wymaga ogromnej siły roboczej i prawie nieprzerwanej pracy, aby tylko dotknąć czubka lodu mowy nienawiści. Aby rozwiązać ten problem, badacze w wielu laboratoriach zaczynają szkolić sztuczną inteligencję (AI), aby pomóc w tym ogromnym zadaniu.
Ikigai cytuję system Rosetta, który Facebook wykorzystuje do sprawdzania autentyczności wiadomości, obrazów lub innych treści, które są publikowane na tej platformie społecznościowej. Jak wyjaśniono, system Rosetta skanuje „słowo, obraz, język, czcionkę, datę publikacji oraz inne zmienne i próbuje ustalić, czy prezentowana informacja jest autentyczna, czy nie.” Po zebraniu informacji i uwzględnieniu faktu, że AI nie jest jeszcze w pełni „zdolna do zrozumienia aluzji, odniesień, podtekstów i kontekstów, w których treść została opublikowana”, ludzcy moderatorzy przejmują kontrolę i kierują systemem AI, aby wykryć mowę nienawiści i fałszywe wiadomości.
Aby spróbować dalej rozwinąć zdolność systemów AI do pokrycia wszystkich możliwych niuansów, które charakteryzują mowę nienawiści, zespół badaczy z UC Santa Barbara i Intel (INTC ), jak podaje TheNextWeb (TNW), „wziął tysiące rozmów z najgorszych społeczności na Reddit i Gab i wykorzystał je do opracowania i szkolenia AI do walki z mową nienawiści.”
Zgodnie z ich raportem, aby to zrobić, wspólny zespół badaczy stworzył specjalny zestaw danych zawierający „tysiące rozmów specjalnie wyselekcjonowanych, aby były pełne mowy nienawiści.” Wykorzystali również listę grup na Reddit, które są głównie charakteryzowane przez użycie mowy nienawiści, skompilowaną przez Justina Caffiera z Vox.
Badacze zebrali „ponad 22 000 komentarzy z Reddit i ponad 33 000 z Gab.” Odkryli, że obie strony pokazują podobne popularne słowa kluczowe nienawiści, ale rozkład jest bardzo inny.
Zauważyli, że ze względu na te różnice jest bardzo trudno dla mediów społecznościowych, aby interweniować w czasie rzeczywistym, ponieważ przepływ mowy nienawiści jest tak duży, że wymagałby to niezliczonej liczby osób, które by go śledziły.
Aby rozwiązać problem, zespół badawczy zaczął szkolić AI do interwencji. Ich początkowa baza danych została wysłana do pracowników Amazon (AMZN ) Turk, aby ją oznaczyć. Po zidentyfikowaniu poszczególnych przypadków mowy nienawiści pracownicy opracowali frazy, które AI mogłoby wykorzystać „do odstraszania użytkowników od publikowania podobnej mowy nienawiści w przyszłości.”
Na podstawie tego zespół „przeszedł ten zestaw danych i bazę interwencji przez różne systemy machine learning i przetwarzania języka naturalnego i stworzył prototyp AI do interwencji przeciwko mowie nienawiści online.”
Wyniki były doskonałe, ale ponieważ rozwój jest jeszcze na wczesnym etapie, system nie jest jeszcze gotowy do aktywnego użycia. Jak wyjaśniono, „system, w teorii, powinien wykryć mowę nienawiści i natychmiast wysłać wiadomość do użytkownika, informując go, dlaczego nie powinien publikować treści, które明显 reprezentują mowę nienawiści. To opiera się na więcej niż tylko wykrywaniu słów kluczowych – aby AI działało, musi uzyskać odpowiedni kontekst.”












