Модели и платформы ИИ
Исследователи начинают тренировать искусственный интеллект для борьбы с ненавистной речью в Интернете
Фейковые новости и ненавистная речь в Интернете становятся не ежедневной, а минутной проблемой. Согласно отчету IkigaiLab, Facebook (META ) и Twitter только недавно закрыли более 1,5 миллиарда и 70 миллионов аккаунтов соответственно, чтобы хотя бы попытаться сдержать распространение фейковых новостей и ненавистной речи по всему миру.
Однако на данный момент такая задача требует огромных человеческих ресурсов и почти постоянной работы, чтобы только слегка затронуть проблему ненавистной речи. Чтобы решить эту проблему, исследователи в различных лабораториях начинают тренировать искусственный интеллект (ИИ), чтобы помочь в этом огромном задании.
Ikigai цитирует систему Rosetta, которую Facebook использует для понимания аутентичности новостей, изображений или другого контента, загружаемого на эту социальную сеть. Как объясняется, система Rosetta сканирует “слово, картинку, язык, шрифт, дату публикации, среди других переменных, и пытается определить, является ли представленная информация подлинной или нет”. После того, как система собирает информацию и учитывая, что ИИ еще не полностью “способен понимать намеки, ссылки, тонкости и контекст, в котором был опубликован контент”, человеческие модераторы берут на себя управление и направляют систему ИИ, чтобы обнаружить ненавистную речь и фейковые новости.
Чтобы попытаться еще больше развить способность систем ИИ охватить все возможные нюансы, характеризующие ненавистную речь, команда исследователей в UC Santa Barbara и Intel (INTC ), как сообщает TheNextWeb (TNW), “взяла тысячи разговоров из самых мерзких сообществ на Reddit и Gab и использовала их для разработки и тренировки ИИ для борьбы с ненавистной речью”.
Согласно их отчету, для этого совместная группа исследователей создала специальный набор данных, включающий “тысячи разговоров, специально отобранных для обеспечения того, чтобы они были полны ненавистной речи”. Они также использовали список групп на Reddit, которые в основном характеризуются использованием ненавистной речи, составленный Джастином Каффьером из Vox.
Исследователи в итоге собрали “более 22 000 комментариев с Reddit и более 33 000 с Gab”. Они обнаружили, что два сайта показывают “podobные популярные ключевые слова ненавистной речи, но распределения очень khácны”.
Они отметили, что из-за этих различий очень трудно социальным сетям вмешаться в реальном времени, поскольку поток ненавистной речи так высок, что для этого потребовалось бы бесчисленное количество реальных людей, чтобы следить за ним.
Чтобы решить эту проблему, команда исследователей начала тренировать ИИ для вмешательства. Их первоначальная база данных была отправлена работникам Amazon (AMZN ) Turk для маркировки. После выявления отдельных случаев ненавистной речи работники разработали фразы, которые ИИ будет использовать “для сдерживания пользователей от публикации подобной ненавистной речи в будущем”.
На основе этого команда “прошла этот набор данных и свою базу данных вмешательств через различные системы машинного обучения и обработки естественного языка и создала своего рода прототип для онлайн-системы ИИ для вмешательства в ненавистную речь”.
Результаты были отличными, но поскольку разработка еще находится на ранней стадии, система еще не готова к активному использованию. Как объясняется, “система, в теории, должна обнаруживать ненавистную речь и сразу же отправлять сообщение постеру, объясняя, почему он не должен публиковать вещи, которые явно представляют ненавистную речь. Это зависит не только от обнаружения ключевых слов – для того, чтобы ИИ работал, он должен правильно понять контекст”.












