Этика

Google Раскрывает Использование Публичных Данных Веба в Обучении ИИ

mm
Добавьте Unite.AI в избранные источники в Google

В недавнем обновлении своей политики конфиденциальности Google (GOOGL ) открыто признал использование публично доступной информации из сети для обучения своих моделей ИИ. Это раскрытие, обнаруженное Gizmodo, включает сервисы like Bard и Cloud AI. Представитель Google Christa Muldoon заявила The Verge, что обновление просто уточняет, что новые сервисы, такие как Bard, также включены в эту практику, и что Google включает принципы и гарантии конфиденциальности в разработку своих технологий ИИ.

Прозрачность в практиках обучения ИИ – это шаг в правильном направлении, но она также вызывает множество вопросов. Как Google обеспечивает конфиденциальность отдельных лиц при использовании публично доступных данных? Какие меры предпринимаются для предотвращения неправильного использования этих данных?

Последствия Методов Обучения ИИ Google

Обновленная политика конфиденциальности теперь гласит, что Google использует информацию для улучшения своих сервисов и для разработки новых продуктов, функций и технологий, которые приносят пользу пользователям и обществу. Политика также уточняет, что компания может использовать публично доступную информацию для обучения моделей ИИ Google и создания продуктов и функций, таких как Google Translate, Bard и Cloud AI.

Однако политика не уточняет, как Google будет предотвращать включение в пул данных для обучения материалов, защищенных авторским правом. Многие публично доступные веб-сайты имеют политику, запрещающую сбор данных или веб-скрейпинг для цели обучения больших языковых моделей и других инструментов ИИ. Этот подход может потенциально конфликтовать с глобальными регуляциями, такими как GDPR, которые защищают людей от неправильного использования их данных без их явного разрешения.

Использование публично доступных данных для обучения ИИ не является по своей сути проблематичным, но оно становится таковым, когда оно нарушает авторские права и индивидуальную конфиденциальность. Это хрупкий баланс, который компании, такие как Google, должны тщательно соблюдать.

Более Широкое Влияние Практик Обучения ИИ

Использование публично доступных данных для обучения ИИ было предметом споров. Популярные генеративные системы ИИ, такие как OpenAI’s GPT-4, были неохотны раскрывать свои источники данных и то, включают ли они посты в социальных сетях или произведения, защищенные авторским правом, созданные человеческими художниками и авторами. Эта практика в настоящее время находится в серой зоне, вызывая различные судебные иски и побуждая законодателей в некоторых странах ввести более строгие законы для регулирования того, как компании ИИ собирают и используют свои данные для обучения.

Крупнейший издатель газет в США, Gannett, судится с Google и ее материнской компанией, Alphabet (GOOG ), утверждая, что достижения в технологии ИИ помогли поисковому гиганту удержать монополию на рынке цифровой рекламы. Тем временем социальные платформы, такие как Twitter и Reddit, приняли меры для предотвращения того, чтобы другие компании могли свободно собирать их данные, что привело к негативной реакции со стороны их соответствующих сообществ.

Эти разработки подчеркивают необходимость прочных этических руководств в ИИ. По мере того, как ИИ продолжает развиваться, важно для компаний сбалансировать технологический прогресс с этическими соображениями. Это включает уважение авторских прав, защиту индивидуальной конфиденциальности и обеспечение того, чтобы ИИ приносил пользу всему обществу, а не только избранным.

Недавнее обновление политики конфиденциальности Google проливает свет на практику обучения ИИ компании. Однако оно также вызывает вопросы об этических последствиях использования публично доступных данных для обучения ИИ, потенциальном нарушении авторских прав и влиянии на конфиденциальность пользователей. По мере того, как мы движемся вперед, важно продолжать этот разговор и работать над будущим, в котором ИИ разрабатывается и используется ответственно.

Алекс Макфарленд - журналист и писатель в области искусственного интеллекта, исследующий последние разработки в этой области. Он сотрудничал с многочисленными стартапами и изданиями в области искусственного интеллекта во всем мире.