Wywiady

Denas Grybauskas, Chief Governance and Strategy Officer at Oxylabs – Wywiad

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Denas Grybauskas jest Chief Governance and Strategy Officer w firmie Oxylabs, światowym liderem w zakresie zbierania informacji z sieci i premium proxy rozwiązań.

Założona w 2015 roku Oxylabs oferuje jeden z największych na świecie etycznie pozyskiwanych sieci proxy – obejmujący ponad 177 milionów adresów IP w 195 krajach – wraz z zaawansowanymi narzędziami, takimi jak Web Unblocker, Web Scraper API i OxyCopilot, asystent scrappingu AI, który konwertuje naturalny język na zapytania danych strukturalnych.

Miałeś imponującą karierę prawniczą i rządową w litewskiej branży technologicznej. Co osobiste motywowało cię do podjęcia jednego z najbardziej kontrowersyjnych wyzwań AI – etyki i prawa autorskiego – w swojej roli w Oxylabs?

Oxylabs zawsze była pionierem odpowiedzialnej innowacji w branży. Byliśmy pierwszymi, którzy opowiedzieli się za etycznym pozyskiwaniem proxy i standardami branżowymi scrappingu sieci. Teraz, gdy AI rozwija się tak szybko, musimy upewnić się, że innowacja jest zrównoważona z odpowiedzialnością.

Widzieliśmy to jako ogromny problem branży AI i widzieliśmy również rozwiązanie. Poprzez dostarczanie tych zestawów danych, umożliwiamy firmom AI i twórcom, aby byli na tej samej stronie co sprawiedliwy rozwój AI, co jest korzystne dla wszystkich stron. Wiedzieliśmy, jak ważne jest utrzymanie praw twórców na pierwszym planie, ale także dostarczanie treści do rozwoju przyszłych systemów AI, więc stworzyliśmy te zestawy danych jako coś, co może spełnić wymagania dzisiejszego rynku.

W Wielkiej Brytanii toczy się gorąca bitwa o prawa autorskie, z silnymi głosami po obu stronach. Jak interpretujesz obecny stan debaty między innowacjami AI a prawami twórców?

Podczas gdy ważne jest, aby rząd Wielkiej Brytanii faworyzował produktywne innowacje technologiczne jako priorytet, równie ważne jest, aby twórcy czuli się wzmocnieni i chronieni przez AI, a nie okradzeni. Obecny prawniczy spór musi znaleźć słodkie miejsce między wspieraniem innowacji a jednoczesnym chronieniem twórców, i mam nadzieję, że w nadchodzących tygodniach uda im się znaleźć sposób na znalezienie równowagi.

Oxylabs właśnie uruchomił światowy pierwszy etyczny zestaw danych YouTube, który wymaga zgody twórców na szkolenie AI. Jak dokładnie działa ten proces zgody – i jak skalowalny jest on dla innych branż, takich jak muzyka czy publikacje?

Wszystkie miliony oryginalnych filmów w zestawach danych mają wyraźną zgodę twórców na wykorzystanie do szkolenia AI, łącząc twórców i innowatorów w sposób etyczny. Wszystkie zestawy danych oferowane przez Oxylabs obejmują filmy, transkrypcje i bogate metadane. Chociaż takie dane mają wiele potencjalnych zastosowań, Oxylabs udoskonalił i przygotował je specjalnie do szkolenia AI, co jest zastosowaniem, na które twórcy wyraźnie zgodzili się.

Wiele liderów technologicznych twierdzi, że wymaganie wyraźnej zgody od wszystkich twórców może “zabić” branżę AI. Jaka jest twoja odpowiedź na to twierdzenie, i jak podejście Oxylabs dowodzi, że jest inaczej?

Wymaganie, aby dla każdego użycia materiału do szkolenia AI, było wcześniej wyraźne potwierdzenie, stanowi znaczne wyzwania operacyjne i pociąga za sobą znaczne koszty innowacji AI. Zamiast chronić prawa twórców, mogłoby nieumyślnie zachęcać firmy do przeniesienia działalności do jurysdykcji z mniej rygorystycznymi przepisami lub różnymi reżimami prawa autorskiego. Jednakże, nie oznacza to, że nie ma miejsca na kompromis, w którym rozwój AI jest wspierany, a jednocześnie szanowane są prawa autorskie. Co potrzebujemy, to funkcjonalne mechanizmy, które ułatwiają relację między firmami AI a twórcami.

Te zestawy danych oferują jeden ze sposobów na przyszłość. Model opt-out, w którym zawartość może być wykorzystywana, chyba że właściciel praw autorskich wyraźnie się sprzeciwi, jest innym. Trzecim sposobem byłoby ułatwienie negocjacji między wydawcami, twórcami i firmami AI za pomocą rozwiązań technologicznych, takich jak platformy online.

Ostatecznie, każde rozwiązanie musi działać w ramach obowiązujących przepisów prawa autorskiego i ochrony danych. W Oxylabs wierzymy, że innowacje AI muszą być prowadzone w sposób odpowiedzialny, a naszym celem jest przyczynienie się do stworzenia legalnych, praktycznych ram, które szanują twórców, a jednocześnie umożliwiają postęp.

Jakie były największe przeszkody, które twoja drużyna musiała pokonać, aby uczynić zestawy danych opartych na zgodzie?

Droga dla nas została otwarta przez YouTube, umożliwiając twórcom łatwe i wygodne udzielanie licencji na swoje prace do szkolenia AI. Po tym, nasza praca była głównie techniczna, polegająca na gromadzeniu danych, czyszczeniu i strukturyzowaniu ich w celu przygotowania zestawów danych, a także budowaniu całej technicznej infrastruktury, aby firmy mogły uzyskać dostęp do danych, których potrzebują. Ale to jest coś, co robimy od lat, w jednej czy innej formie. Oczywiście, każdy przypadek przedstawia swoje własne wyzwania, szczególnie gdy masz do czynienia z czymś tak ogromnym i złożonym, jak dane multimodalne. Ale mieliśmy zarówno wiedzę, jak i techniczną możliwość, aby to zrobić. Biorąc to pod uwagę, gdy autorzy YouTube otrzymali szansę na udzielenie zgody, reszta była tylko kwestią poświęcenia czasu i zasobów.

Czy widzisz przyszłość, w której inne główne typy treści – takie jak muzyka, pisanie czy sztuka cyfrowa – mogą być również systematycznie licencjonowane do użycia jako dane szkoleniowe?

Od jakiegoś czasu wskazujemy na potrzebę systematycznego podejścia do udzielania zgody i licencjonowania treści w celu umożliwienia innowacji AI, przy jednoczesnym zachowaniu praw twórców. Dopiero wtedy, gdy istnieje wygodny i współpracujący sposób, aby obie strony osiągały swoje cele, będzie korzyść wzajemna.

To jest tylko początek. Wierzymy, że dostarczanie zestawów danych, takich jak nasze, w różnych branżach, może zapewnić rozwiązanie, które w końcu doprowadzi do przyjaznego zakończenia debaty o prawach autorskich.

Czy znaczenie ofert, takich jak etyczne zestawy danych Oxylabs, różni się w zależności od różnych podejść do zarządzania AI w UE, Wielkiej Brytanii i innych jurysdykcjach?

Z jednej strony, dostępność zestawów danych opartych na wyraźnej zgodzie wyrównuje pole gry dla firm AI z siedzibą w jurysdykcjach, gdzie rządy skłaniają się ku surowszym regulacjom. Głównym problemem tych firm jest to, że surowe przepisy dotyczące uzyskania zgody nie będą wspierać twórców, ale raczej dadzą niesprawiedliwą przewagę firmom AI w innych jurysdykcjach. Problem nie polega na tym, że te firmy nie dbają o zgodę, ale raczej na tym, że bez wygodnego sposobu na jej uzyskanie, są skazane na pozostanie w tyle.

Z drugiej strony, wierzymy, że jeśli udzielanie zgody i uzyskiwanie danych licencjonowanych do szkolenia AI zostanie uproszczone, nie ma powodu, dla którego ten podejście nie mógłby stać się preferowanym na całym świecie. Nasze zestawy danych oparte na licencjonowanych treściach YouTube są krokiem w kierunku tego uproszczenia.

Jak myślisz, że przejrzystość i zgoda mogą stać się przewagą konkurencyjną dla firm technologicznych?

Chociaż przejrzystość jest często postrzegana jako przeszkoda dla przewagi konkurencyjnej, jest to również nasza największa broń do walki z brakiem zaufania. Im więcej przejrzystości firmy AI mogą zapewnić, tym więcej dowodów jest na to, że szkolenie AI jest etyczne i korzystne, co odbudowuje zaufanie do branży AI. A z kolei, twórcy widząc, że mogą uzyskać korzyści z innowacji AI, będą mieli więcej powodów, aby wyrazić zgodę w przyszłości.

Oxylabs jest często kojarzony z scrapingiem danych i inteligencją sieciową. Jak ta nowa inicjatywa etyczna wpisuje się w szerszą wizję firmy?

Wydanie etycznie pozyskanych zestawów danych YouTube kontynuuje naszą misję w Oxylabs, aby ustanowić i promować etyczne praktyki branżowe. W ramach tego, współzałożyliśmy Inicjatywę Etycznego Zbierania Danych Sieciowych (EWDCI) i wprowadziliśmy przełomową, transparentną strukturę poziomów dla źródeł proxy. Uruchomiliśmy również Projekt 4β w ramach naszej misji, aby umożliwić badaczom i naukowcom maksymalizowanie wpływu ich badań i zwiększenie zrozumienia krytycznych publicznych danych sieciowych.

Spójrzając w przyszłość, czy uważasz, że rządy powinny nakazywać zgodę domyślną dla danych szkoleniowych, czy powinno to pozostać dobrowolną inicjatywą branżową?

W gospodarce rynkowej najlepiej jest pozwolić rynkowi samemu się poprawić. Pozwalając na rozwój innowacji w odpowiedzi na potrzeby rynku, ciągle wynajdujemy i odnawiamy nasze dobrobyt. Ustawodawstwo nie powinno być pierwszym wyborem i powinno być stosowane tylko wtedy, gdy wszystkie inne środki, aby zapewnić sprawiedliwość, pozwalając na innowacje, zostały wyczerpane.

Nie wydaje się, że już osiągnęliśmy ten punkt w szkoleniu AI. Opcje licencjonowania YouTube dla twórców i nasze zestawy danych pokazują, że ten ekosystem aktywnie szuka sposobów na adaptację do nowych rzeczywistości. Zatem, chociaż jasne regulacje są oczywiście potrzebne, aby upewnić się, że każdy działa w ramach swoich praw, rządy mogą chcieć postępować ostrożnie. Zamiast wymagać wyraźnej zgody w każdym przypadku, mogą chcieć zbadać, w jaki sposób branże mogą rozwijać mechanizmy do rozwiązywania obecnych napięć i brać pod uwagę to przy ustawodawstwie, aby zachęcać do innowacji, a nie hamować ich.

Jakie porady byś udzielił startupom i deweloperom AI, którzy chcą priorytetowo traktować etyczne wykorzystanie danych, nie zwalniając innowacji?

Jednym ze sposobów, w jaki startupy mogą pomóc w ułatwieniu etycznego wykorzystania danych, jest rozwijanie rozwiązań technologicznych, które upraszczają proces uzyskiwania zgody i tworzenia wartości dla twórców. Gdy pojawiają się opcje pozyskiwania transparentnie pozyskanych danych, firmy AI nie muszą kompromisować szybkości; dlatego radzę im, aby trzymali oczy otwarte na takie oferty.

 Dziękuję za wspaniały wywiad, czytelnicy, którzy chcą dowiedzieć się więcej, powinni odwiedzić Oxylabs.

Antoine jest wizjonerskim liderem i współzałożycielem Unite.AI, który jest zmotywowany niezachwianą pasją do kształtowania i promowania przyszłości sztucznej inteligencji i robotyki. Jako serialowy przedsiębiorca, wierzy, że sztuczna inteligencja będzie tak samo przełomowa dla społeczeństwa, jak elektryczność, i często jest złapany na tym, że zachwala potencjał przełomowych technologii i AGI.

Jako futurysta, jest poświęcony badaniu, jak te innowacje ukształtują nasz świat. Ponadto, jest założycielem Securities.io, platformy skupiającej się na inwestowaniu w najnowocześniejsze technologie, które zmieniają przyszłość i przebudowują całe sektory.