Інтерв’ю
Денас Грябаускас, начальник відділу управління та стратегії компанії Oxylabs – Інтерв’ю серія

Денас Грябаускас є начальником відділу управління та стратегії компанії Oxylabs, світового лідера у сфері збору вебінтелекту та преміум-проксі рішень.
Заснована у 2015 році, Oxylabs пропонує одну з найбільших етично джерел проксі-мереж у світі – понад 177 мільйонів IP-адрес у 195 країнах, а також передові інструменти, такі як Web Unblocker, Web Scraper API та OxyCopilot, штучний інтелект, що підтримує скрапінг та перетворює природну мову у структуровані запитувальні дані.
У вас була вражаюча юридична та управлінська кар’єра у сфері юридичної техніки Литви. Що особисто мотивувало вас вирішити одну з найбільш поляризованих проблем штучного інтелекту – етику та авторське право – на вашій посаді в Oxylabs?
Oxylabs завжди були піонерами відповідальної інновації в галузі. Ми були першими, хто відстоював етичне джереління проксі та стандарти скрапінгу вебу. Тепер, коли штучний інтелект розвивається так швидко, нам потрібно забезпечити, щоб інновації були збалансовані з відповідальністю.
Ми бачили цю проблему як величезну для галузі штучного інтелекту, і ми також бачили рішення. Надавши ці набори даних, ми дозволяємо компаніям штучного інтелекту та творцям бути на одному рівні щодо справедливого розвитку штучного інтелекту, що є корисним для всіх учасників. Ми знали, наскільки важливо зберегти права творців на передньому плані, але також надати контент для розвитку майбутніх систем штучного інтелекту, тому ми створили ці набори даних як щось, що може задовольнити вимоги сучасного ринку.
У Великій Британії триває гаряча битва за авторське право, з потужними голосами з обох сторін. Як ви інтерпретуєте поточний стан дебатів між інноваціями штучного інтелекту та правами творців?
Хоча важливо, щоб уряд Великої Британії віддавав пріоритет продуктивним технологічним інноваціям, важливо, щоб творці відчували себе посилені та захищені штучним інтелектом, а не вкрадені. Правовий каркас, який зараз обговорюється, повинен знайти золотий середину між сприянням інноваціям та захистом творців, і я сподіваюсь, що в найближчі тижні вони знайдуть спосіб знайти баланс.
Oxylabs тільки що запустила перший у світі етичний набір даних YouTube, який вимагає згоди творців для навчання штучного інтелекту. Як саме працює цей процес згоди – і наскільки він масштабований для інших галузей, таких як музика чи видавництво?
Усі мільйони оригінальних відео у наборах даних мають явну згоду творців на використання для навчання штучного інтелекту, з’єднуючи творців та інноваторів етично. Усі набори даних, пропоновані Oxylabs, включають відео, транскрипти та багаті метадані. Хоча такі дані мають багато потенційних випадків використання, Oxylabs відточили та підготували їх конкретно для навчання штучного інтелекту, яке є використанням, на яке творці свідомо погодилися.
Багато лідерів технологій стверджують, що вимога явної згоди від усіх творців може “вбити” галузь штучного інтелекту. Яка ваша відповідь на це твердження, і як підхід Oxylabs доводить протилежне?
Вимога явної згоди для кожного використання матеріалів для навчання штучного інтелекту представляє значні операційні виклики та буде коштувати значних коштів для інновацій штучного інтелекту. Замість захисту прав творців це може ненавмисно заохотити компанії перенести діяльність у юрисдикції з менш суворим дотриманням або різними режимами авторського права. Однак це не означає, що немає середнього ґрунту, де розвиток штучного інтелекту заохочується, а авторське право поважається. Навпаки, нам потрібні дієві механізми, які спрощують відносини між компаніями штучного інтелекту та творцями.
Ці набори даних пропонують один із підходів до руху вперед. Модель “опт-аут”, згідно з якою контент можна використовувати, якщо власник авторського права явно не відмовився, – це інший підхід. Третій спосіб – це сприяння домовленостям між видавцями, творцями та компаніями штучного інтелекту через технологічні рішення, такі як онлайн-платформи.
У кінцевому підсумі будь-яке рішення повинно діяти в межах застосовних законів про авторське право та захист даних. У Oxylabs ми вважаємо, що інновації штучного інтелекту повинні проводитися відповідально, і нашою метою є внесок у законні, практичні рамки, які поважають творців, а також забезпечують прогрес.
Які були найбільші перешкоди, які ваша команда мала подолати, щоб зробити набори даних на основі згоди життєздатними?
Шлях для нас був відкритий YouTube, який дозволив творцям легко та зручно ліцензувати свою роботу для навчання штучного інтелекту. Після цього наша робота була в основному технічною, включаючи збір даних, очищення та структуризацію їх для підготовки наборів даних, а також створення технічної бази для доступу компаній до необхідних даних. Але це щось, що ми робили протягом років, одним чи іншим способом. Очевидно, що кожен випадок представляє свої власні виклики, особливо коли ви маєте справу з чимось таким величезним і складним, як багатомодальні дані. Але у нас були знання та технічна здатність зробити це. Отже, як тільки автори YouTube отримали можливість дати згоду, все, що залишилося, – це витратити час та ресурси на це.
Поза контентом YouTube чи бачите ви майбутнє, в якому інші великі типи контенту – такі як музика, письмо чи цифрове мистецтво – також можуть бути систематично ліцензовані для використання як навчальних даних?
Уже деякий час ми вказували на необхідність системного підходу до надання згоди та ліцензування контенту, щоб забезпечити інновації штучного інтелекту, збалансовані з правами творців. Лише коли є зручний і співробітницький спосіб для обох сторін досягти своїх цілей, буде взаємна вигода.
Це тільки початок. Ми вважаємо, що надання наборів даних, таких як наші, у різних галузях, може забезпечити рішення, яке нарешті приведе дебати про авторське право до мирного завершення.
Чи варіюється важливість пропозицій, таких як етичні набори даних Oxylabs, залежно від різних підходів до управління штучним інтелектом в ЄС, Великій Британії та інших юрисдикціях?
З одного боку, наявність наборів даних на основі явної згоди рівнює умови для компаній штучного інтелекту, які базуються в юрисдикціях, де уряди схиляються до суворішого регулювання. Основною проблемою цих компаній є те, що суворі правила отримання згоди можуть лише надати несправедливу перевагу розробникам штучного інтелекту в інших юрисдикціях. Проблема не в тому, що ці компанії не турбуються про згоду, а в тому, що без зручного способу її отримання вони засуджені відставати.
З іншого боку, ми вважаємо, що якщо надання згоди та доступ до ліцензованих даних для навчання штучного інтелекту спрощується, немає причини, чому цей підхід не повинен стати переважним у світі. Наші набори даних, побудовані на основі ліцензованого контенту YouTube, – це крок до цього спрощення.
З ростом недовіри громадськості до того, як тренується штучний інтелект, як ви думаєте, що прозорість та згода можуть стати конкурентними перевагами для технологічних компаній?
Хоча прозорість часто розглядається як перепона для конкурентної переваги, це також наш найсильніший засіб боротьби з недовірою. Чим більше прозорості компаніям штучного інтелекту можна забезпечити, тим більше доказів є для етичного та корисного навчання штучного інтелекту, тим більше довіри до галузі штучного інтелекту. І навпаки, творці, побачивши, що вони та суспільство можуть отримати вигоду від інновацій штучного інтелекту, матимуть більше підстав дати згоду в майбутньому.
Oxylabs часто асоціюється з скрапінгом даних та вебінтелектом. Як ця нова етична ініціатива вписується у ширшу місію компанії?
Випуск етично джерелених наборів даних YouTube продовжує нашу місію в Oxylabs щодо встановлення та сприяння етичним практикам галузі. Як частина цього, ми співзаснували Ініціативу етичного збору вебданих (EWDCI) та ввели прозорий каркас для джереління проксі. Ми також запустили Проект 4β як частину нашої місії, щоб дозволити дослідникам та академікам максимізувати свій дослідницький вплив та покращити розуміння критичної публічної вебданих.
Оглядаючи майбутнє, чи думаєте ви, що уряди повинні зобов’язати згоду за замовчуванням для навчальних даних, або це повинно залишитися добровільною ініціативою галузі?
У вільній ринковій економіці найкраще дозволити ринку виправити себе. Дозволяючи інноваціям розвиватися у відповідь на ринкові потреби, ми постійно винаходимо та оновлюємо нашу добробут. Тяжке законодавство ніколи не є добрим першим вибором і повинно застосовуватися лише тоді, коли всі інші шляхи забезпечення справедливості, одночасно дозволяючи інноваціям, вичерпані.
Це не виглядає так, як ніби ми вже досягли цієї точки в навчанні штучного інтелекту. Ліцензійні варіанти YouTube для творців та наші набори даних демонструють, що ця екосистема активно шукає способи адаптуватися до нових реалій. Отже, хоча чітке регулювання, безумовно, потрібно для забезпечення того, щоб всі діяли у межах своїх прав, уряди можуть хотіти тaktulightly. Замість того, щоб вимагати вираженої згоди в кожному випадку, вони можуть хочуть розглянути способи, як галузі можуть розробити механізми для вирішення поточних напружень та брати сигнали з цього при законодавстві для заохочення інновацій, а не їх гальмування.
Яку пораду ви дали б стартапам та розробникам штучного інтелекту, які хочуть пріоритизувати етичне використання даних без гальмування інновацій?
Один із способів, яким стартапи можуть сприяти етичному використанню даних, – це розробка технологічних рішень, які спрощують процес отримання згоди та отримання вигоди для творців. Як тільки з’являються варіанти придбання прозорих джерел даних, компанії штучного інтелекту не повинні компрометувати швидкість; тому я раджу їм тримати очі відкритими для таких пропозицій.
Дякую за велике інтерв’ю, читачам, які хочуть дізнатися більше, слід відвідати Oxylabs.












