Modele și platforme AI
Cercetătorii Încep Să Antreneze Inteligența Artificială Pentru A Combate Discursul De Ură Online
Știrile false și discursul de ură online devin nu o problemă zilnică, ci o problemă care apare la fiecare minut online. IkigaiLab raportează că Facebook (META ) și Twitter au trebuit recent să închidă peste 1,5 miliarde și, respectiv, 70 de milioane de conturi pentru a încerca să limiteze răspândirea știrilor false și a discursului de ură din întreaga lume.
Încă, în acest moment, o astfel de sarcină necesită o putere umană enormă și ore de muncă aproape constante pentru a aborda doar vârful icebergului discursului de ură. Pentru a rezolva problema, cercetătorii din numeroase laboratoare încep să antreneze inteligența artificială (IA) pentru a ajuta la această sarcină imensă.
Ikigai citează sistemul Rosetta pe care Facebook îl utilizează pentru a înțelege autenticitatea știrilor, a imaginilor sau a altor conținuturi încărcate pe această rețea socială. Așa cum se explică, ceea ce face Rosetta este să scaneze “cuvântul, imaginea, limba, fontul, data postării printre alte variabile și încearcă să vadă dacă informația prezentată este autentică sau nu.” După ce sistemul adună informațiile și ținând cont de faptul că IA nu este încă pe deplin “capabilă să înțeleagă aluziile, referințele, aluziile și contextele în care conținutul a fost postat,” moderatorii umani preiau controlul și îndrumă sistemul IA pentru a descoperi discursul de ură și știrile false.
Pentru a încerca să dezvolte mai departe capacitatea sistemelor IA de a acoperi toate nuanțele posibile care caracterizează discursul de ură, o echipă de cercetători de la UC Santa Barbara și Intel (INTC ), așa cum raportează TheNextWeb (TNW), “a luat mii de conversații din cele mai murdare comunități de pe Reddit și Gab și le-a utilizat pentru a dezvolta și antrena IA pentru a combate discursul de ură.”
Conform raportului lor, pentru a face acest lucru, grupul comun de cercetători a creat un set de date special care conține “mii de conversații selectate special pentru a se asigura că vor fi pline de discurs de ură.” Ei au utilizat, de asemenea, o listă a grupurilor de pe Reddit care sunt caracterizate în principal prin utilizarea discursului de ură, compilată de Justin Caffier de la Vox.
Cercetătorii au adunat “mai mult de 22.000 de comentarii de pe Reddit și peste 33.000 de pe Gab.” Ei au descoperit că cele două site-uri arată cuvinte-cheie populare de ură similare, dar distribuțiile sunt foarte diferite.
Ei au observat că, din cauza acestor diferențe, este foarte greu pentru rețelele sociale, în general, să intervină în timp real, deoarece fluxul de discurs de ură este atât de mare încât ar necesita o mulțime de persoane pentru a-l urmări.
Pentru a aborda problema, echipa de cercetare a început să antreneze IA pentru a interveni. Baza lor de date inițială a fost trimisă lucrătorilor de pe Amazon (AMZN ) Turk pentru a fi etichetată. După identificarea instanțelor individuale de discurs de ură, lucrătorii au venit cu fraze pe care IA le-ar utiliza “pentru a descuraja utilizatorii să posteze discurs de ură similar în viitor.”
Pe baza acestor date, echipa “a rulat acest set de date și baza de date de intervenții prin diverse sisteme de învățare automată și procesare a limbajului natural și a creat un fel de prototip pentru un sistem IA de intervenție împotriva discursului de ură online.”
Rezultatele obținute au fost excelente, dar, deoarece dezvoltarea este încă într-un stadiu incipient, sistemul nu este încă gata să fie utilizat activ. Așa cum se explică, “sistemul, în teorie, ar trebui să detecteze discursul de ură și să trimită imediat un mesaj posterului, informându-l de ce nu ar trebui să posteze lucruri care reprezintă evident discurs de ură. Acest lucru se bazează pe mai mult decât doar detectarea cuvintelor-cheie – pentru ca IA să funcționeze, trebuie să înțeleagă contextul corect.”












