Интервью

Денас Грябаускас, главный офицер по управлению и стратегии в Oxylabs – Интервью

mm
Добавьте Unite.AI в избранные источники в Google

Денас Грябаускас является главным офицером по управлению и стратегии в Oxylabs, глобальном лидере в области сбора веб-интеллекта и премиум-прокси решений.

Основанная в 2015 году, Oxylabs предоставляет одну из крупнейших сетей прокси с этическим исходом в мире – охватывающую более 177 миллионов IP-адресов в 195 странах – вместе с передовыми инструментами, такими как Web Unblocker, Web Scraper API и OxyCopilot, помощник скрапинга на основе ИИ, который преобразует естественный язык в структурированные запросы данных.

У вас была впечатляющая юридическая и управленческая карьера в области юридической технологии Литвы. Что лично мотивировало вас решить одну из наиболее поляризующих проблем ИИ – этику и авторское право – в вашей роли в Oxylabs?

Oxylabs всегда были знаменосцами ответственной инновации в отрасли. Мы были первыми, кто выступил за этический исход прокси и отраслевые стандарты веб-скрапинга. Теперь, когда ИИ развивается так быстро, мы должны убедиться, что инновации сбалансированы с ответственностью.

Мы увидели эту проблему как огромную проблему, с которой сталкивается отрасль ИИ, и мы также увидели решение. Предоставляя эти наборы данных, мы ermögаем компаниям ИИ и создателям быть на одной странице в отношении справедливого развития ИИ, что полезно для всех участников. Мы знали, насколько важно уделять первоочередное внимание правам создателей, но также предоставлять контент для разработки будущих систем ИИ, поэтому мы создали эти наборы данных как нечто, что может удовлетворить требования сегодняшнего рынка.

Великобритания находится в разгаре ожесточенной битвы за авторское право, с сильными голосами на обеих сторонах. Как вы интерпретируете текущее состояние дебатов между инновациями ИИ и правами создателей?

Хотя важно, чтобы правительство Великобритании отдало приоритет продуктивным технологическим инновациям, важно, чтобы создатели чувствовали себя усиленными и защищенными ИИ, а не украденными у них. Правовой каркас, который в настоящее время обсуждается, должен найти золотую середину между содействием инновациям и, в то же время, защитой создателей, и я надеюсь, что в ближайшие недели мы увидим, как они найдут способ сбалансировать это.

Oxylabs только что запустила первый в мире этический набор данных YouTube, который требует согласия создателей для обучения ИИ. Как именно работает этот процесс согласия – и насколько он масштабируем для других отраслей, таких как музыка или издательство?

Все миллионы оригинальных видеороликов в наборах данных имеют явное согласие создателей на использование для обучения ИИ, соединяя создателей и инноваторов этически. Все наборы данных, предлагаемые Oxylabs, включают видеоролики, транскрипты и богатые метаданные. Хотя такие данные имеют множество потенциальных вариантов использования, Oxylabs усовершенствовал и подготовил их специально для обучения ИИ, что является использованием, на которое создатели контента явно согласились.

Многие лидеры технологий утверждают, что требование явного согласия от всех создателей может “убить” отрасль ИИ. Что вы можете сказать в ответ на это утверждение, и как подход Oxylabs доказывает обратное?

Требование, чтобы для каждого использования материала для обучения ИИ было предварительное явное согласие, представляет значительные операционные проблемы и будет иметь значительную стоимость для инноваций ИИ. Вместо защиты прав создателей это может непреднамеренно стимулировать компании перенести деятельность по разработке в юрисдикции с менее строгим соблюдением или различными режимами авторского права. Однако это не означает, что нет золотой середины, где развитие ИИ поощряется, а авторское право уважается. Напротив, нам нужны работающие механизмы, которые упрощают отношения между компаниями ИИ и создателями.

Эти наборы данных предлагают один из подходов к движению вперед. Модель, в которой контент может быть использован, если только владелец авторского права не явно не отказался от этого, является еще одним. Третий способ – облегчение заключения сделок между издателями, создателями и компаниями ИИ через технологические решения, такие как онлайн-платформы.

В конечном итоге, любое решение должно действовать в рамках применимых законов об авторском праве и защите данных. В Oxylabs мы считаем, что инновации ИИ должны проводиться ответственно, и нашей целью является вклад в законные, практические рамки, которые уважают создателей, позволяя прогрессу.

Какие были самые большие препятствия, которые ваша команда должна была преодолеть, чтобы сделать наборы данных на основе согласия жизнеспособными?

Путь для нас был открыт YouTube, который позволил создателям контента легко и удобно лицензировать свою работу для обучения ИИ. После этого наша работа была в основном технической, включая сбор данных, очистку и структурирование их для подготовки наборов данных, а также создание всей технической базы для того, чтобы компании могли получить доступ к необходимым данным. Но это то, что мы делали в течение многих лет, в той или иной форме. Конечно, каждый случай представляет свои собственные проблемы, особенно когда вы имеете дело с чем-то таким огромным и сложным, как многомодальные данные. Но у нас были и знания, и техническая возможность сделать это. Учитывая это, как только авторы YouTube получили возможность дать согласие, остальное было только вопросом времени и ресурсов.

За пределами контента YouTube вы представляете себе будущее, в котором другие основные типы контента – такие как музыка, письмо или цифровое искусство – также могут быть систематически лицензированы для использования в качестве обучающих данных?

В течение некоторого времени мы подчеркивали необходимость системного подхода к согласию и лицензированию контента, чтобы позволить инновациям ИИ, сбалансированным с правами создателей. Только когда есть удобный и кооперативный способ для обеих сторон достичь своих целей, будет взаимная выгода.

Это только начало. Мы считаем, что предоставление наборов данных, таких как ours, в различных отраслях, может предоставить решение, которое наконец-то приведет дебаты об авторском праве к мирному завершению.

Важно ли предложение наборов данных Oxylabs с учетом различных подходов к управлению ИИ в ЕС, Великобритании и других юрисдикциях?

С одной стороны, наличие наборов данных на основе явного согласия выравнивает поле для компаний ИИ, базирующихся в юрисдикциях, где правительства склоняются к более строгому регулированию. Основная проблема этих компаний заключается в том, что, вместо того, чтобы поддерживать создателей, строгие правила получения согласия дадут несправедливое преимущество разработчикам ИИ в других юрисдикциях. Проблема не в том, что эти компании не заботятся о согласии, а в том, что без удобного способа получить его они обречены отстать.

С другой стороны, мы считаем, что если предоставление согласия и доступ к данным, лицензированным для обучения ИИ, упрощается, нет причины, почему этот подход не должен стать предпочтительным глобально. Наши наборы данных, построенные на основе лицензированного контента YouTube, являются шагом к этому упрощению.

С растущим общественным недоверием к тому, как обучается ИИ, как вы думаете, прозрачность и согласие могут стать конкурентными преимуществами для технологических компаний?

Хотя прозрачность часто рассматривается как препятствие для конкурентного преимущества, это также наш величайший инструмент для борьбы с недоверием. Чем больше прозрачности могут предоставить компании ИИ, тем больше доказательств есть для этического и полезного обучения ИИ, тем больше доверия можно восстановить в отрасли ИИ. И, в свою очередь, создатели, видя, что они и общество могут получить выгоду от инноваций ИИ, будут иметь больше причин дать согласие в будущем.

Oxylabs часто ассоциируется с веб-скрапингом и веб-интеллектом. Как эта новая этическая инициатива вписывается в более широкую миссию компании?

Выпуск этических наборов данных YouTube продолжает нашу миссию в Oxylabs по установлению и продвижению этических отраслевых практик. В рамках этого мы стали сооснователями инициативы по этическому сбору веб-данных (EWDCI) и ввели прозрачную структуру уровней для исхода прокси. Мы также запустили проект 4β в рамках нашей миссии по ermögлению исследователям и академикам максимизировать влияние своих исследований и улучшить понимание критически важных публичных веб-данных.

Глядя вперед, считаете ли вы, что правительства должны обязать согласие по умолчанию для обучающих данных, или это должно остаться добровольной инициативой отрасли?

В рыночной экономике обычно лучше позволить рынку исправить себя. Позволяя инновациям развиваться в ответ на рыночные потребности, мы постоянно изобретаем и обновляем нашу процветание. Тяжелоручное законодательство никогда не является хорошим первым выбором и должно использоваться только тогда, когда все другие пути обеспечения справедливости, позволяя инновациям, были исчерпаны.

Похоже, что мы еще не достигли этой точки в обучении ИИ. Варианты лицензирования YouTube для создателей и наши наборы данных демонстрируют, что эта экосистема активно ищет способы адаптироваться к новым реалиям. Таким образом, хотя ясное регулирование, конечно, необходимо для обеспечения того, чтобы все действовали в рамках своих прав, правительства могут хотеть действовать осторожно. Вместо того, чтобы требовать явного согласия в каждом случае, они могут хотеть изучить способы, которыми отрасли могут разработать механизмы для решения текущих напряжений и брать свои сигналы от этого при законодательстве для содействия инновациям, а не препятствовать им.

Какой совет вы можете дать стартапам и разработчикам ИИ, которые хотят уделять приоритетное внимание этическому использованию данных без торможения инноваций?

Одним из способов, которыми стартапы могут помочь облегчить этическое использование данных, является разработка технологических решений, которые упрощают процесс получения согласия и получения выгоды для создателей. Поскольку появляются варианты приобретения прозрачных источников данных, компании ИИ не должны идти на компромисс в отношении скорости; поэтому я советую им держать глаза открытыми для таких предложений.

 Спасибо за отличное интервью, читатели, которые хотят узнать больше, должны посетить Oxylabs.

Антуан - видный лидер и сооснователь Unite.AI, движимый непоколебимой страстью к формированию и продвижению будущего ИИ и робототехники. Как серийный предприниматель, он считает, что ИИ будет столь же разрушительным для общества, как и электричество, и часто увлекается потенциалом разрушительных технологий и ИИ.

Как футуролог, он посвящен исследованию того, как эти инновации будут формировать наш мир. Кроме того, он является основателем Securities.io, платформы, ориентированной на инвестиции в передовые технологии, которые переопределяют будущее и меняют целые сектора.