Modely a platformy AI
Vědci začínají cvičit umělou inteligenci, aby bojovala proti hate speech online
Falešné zprávy a hate speech online se stávají nejen denním, ale i minutovým problémem. IkigaiLab uvádí, že Facebook (META ) a Twitter musely nedávno uzavřít více než 1,5 miliardy a 70 milionů účtů, aby se alespoň pokusily omezit šíření falešných zpráv a hate speech po celém světě.
Přesto je tato úloha stále velmi náročná a vyžaduje enormní lidskou sílu a téměř neustálou práci, aby se alespoň trochu omezilo šíření hate speech. Aby se tento problém vyřešil, vědci v mnoha laboratořích začínají cvičit umělou inteligenci (AI), aby jim pomohla s touto enormní úlohou.
Ikigai citační systém Rosetta, který Facebook používá k ověření autenticity zpráv, obrázků nebo jiného obsahu, který je nahrán na tuto sociální síť. Jak je vysvětleno, Rosetta skenuje „slova, obrázky, jazyk, font, datum příspěvku a další proměnné a snaží se určit, zda informace jsou skutečné nebo ne.“ Po shromáždění informací a s ohledem na to, že AI ještě není plně „schopná pochopit narážky, odkazy, drobné poznámky a kontext, ve kterém byl příspěvek zveřejněn“, přebírají lidské moderátory a vedou AI systém k objevování hate speech a falešných zpráv.
Aby se dále rozvinula schopnost AI systémů pokrýt všechny možné nuance, které charakterizují hate speech, tým vědců z UC Santa Barbara a Intelu, jak uvádí TheNextWeb (TNW), „použil tisíce konverzací ze scummiest komunit na Redditu a Gabu a použil je k vývoji a výcviku AI, aby bojovala proti hate speech.” (INTC )
Podle jejich zprávy, k tomu vytvořili specifický dataset obsahující „tisíce konverzací speciálně vybraných tak, aby byly plné hate speech.” Použili také seznam skupin na Redditu, které jsou většinou charakterizovány použitím hate speech, sestavený Justinem Caffierem z Voxu.
Vědci nakonec shromáždili „více než 22 000 komentářů z Redditu a více než 33 000 z Gabu.” Zjistili, že obě stránky ukazují podobné populární hate klíčová slova, ale distribuce jsou velmi odlišné.
Poznamenali, že kvůli těmto rozdílům je pro sociální média obecně velmi obtížné zasáhnout v reálném čase, protože tok hate speech je tak vysoký, že by to vyžadovalo nekonečné množství skutečných osob, aby to sledovaly.
Aby se tento problém vyřešil, výzkumný tým začal cvičit AI, aby zasáhla. Jejich počáteční databáze byla odeslána pracovníkům Amazon (AMZN ) Turk, aby ji označili. Po identifikaci jednotlivých instancí hate speech pracovníci vytvořili fráze, které by AI použila „k odrazování uživatelů od zveřejňování podobného hate speech v budoucnu.”
Na základě toho tým „spustil tuto databázi a její databázi zásahů prostřednictvím různých strojových učících se a přirozeně jazykových zpracovacích systémů a vytvořil určitý prototyp pro online hate speech intervenční AI.”
Výsledky byly excelente, ale protože vývoj je stále ve velmi rané fázi, systém ještě není připraven k aktivnímu použití. Jak je vysvětleno, „systém by teoreticky měl detekovat hate speech a okamžitě odeslat zprávu přispěvovateli, aby mu řekl, proč by neměl zveřejňovat věci, které zjevně představují hate speech. To závisí na více než jen detekci klíčových slov – aby AI fungovala, musí správně pochopit kontext.”












