Liderzy opinii
Dlaczego prywatność danych będzie najważniejszym technologicznym problemem 2024 roku
W centrum uwagi świata techniki, sztuczna inteligencja napędzana przez czatboty, takie jak ChatGPT, przyciąga uwagę, zmieniając branże, jak je znamy. Z każdym postępem, tradycyjne role znikają – pisarze, guru marketingu, nawet eksperci IT znajdują się na liście zwolnień. W czerwcu 2023 roku aż 3 900 Amerykanów straciło swoje miejsca pracy z powodu sztucznej inteligencji. Jednak ten kryzys jest tylko preludium do tego, co nas czeka.
Ponieważ sztuczna inteligencja kontynuuje swoje podboje w różnych branżach, rośnie fala niepokoju dotycząca naruszeń praw autorskich i prywatności. Pojawia się pytanie: jak możemy zapewnić delikatny balans między postępem a prywatnością?
Istniejące obawy
Aby zacząć, wyjaśnię, jak funkcjonują modele sztucznej inteligencji, takie jak ChatGPT. Generują wyniki na podstawie danych, które uczą się podczas szkolenia. Jeśli model może tworzyć tekst, który wygląda jakby został napisany przez Szekspira w tym samym stylu literatury angielskiej, oznacza to, że już “zobaczył” ten tekst wcześniej podczas przygotowania, zanim został wydany.
W rzeczywistości, algorytmy uczenia maszynowego (ML) za każdym modelem sztucznej inteligencji są szkolone na ogromnych ilościach danych, aby dobrze funkcjonować. Na przykład, istnieją systemy, które pomagają lekarzom w diagnostyce – analizują zdjęcia rentgenowskie i znajdują nieprawidłowości, które mogą wskazywać na określone choroby, takie jak rak płuc. Zwykle są szkolone na milionach obrazów medycznych. Bez tego nie mogliby rozpoznać artefaktów na zdjęciach.
W miarę jak rośnie popyt na narzędzia sztucznej inteligencji, giganci technologiczni coraz częściej zbierają ogromne ilości danych, aby trenować swoje modele. I czasami te dane zawierają wrażliwe informacje o ludziach i organizacjach. Co więcej, często są pozyskiwane przez scrapping milionów stron internetowych bez zgody właścicieli.
To wywołuje publiczne obawy dotyczące prywatności, przejrzystości i kontroli nad informacjami osobistymi w internecie. Badanie Deloitte z 2023 roku ujawniło, że większość respondentów szuka większej ochrony i kontroli nad tym, jak są wykorzystywane ich dane. Niemal dziewięć na dziesięć osób wyraziło chęć przeglądania i kasowania zebranych danych, a 80% uważa, że powinno otrzymać rekompensatę za korzystanie z ich danych przez firmy. W samych Stanach Zjednoczonych obywatele stali się bardziej zaniepokojeni tym, jak są wykorzystywane ich dane, a około siedem na dziesięć dorosłych (71%) dzieli tych samych obaw, w porównaniu z 64% w 2019 roku.
Bitwy prawne
Ponadto, niektóre organizacje prowadzą te sprawy do sądu. Według Fortune, do listopada 2023 roku było ponad 100 pozwów związanych ze sztuczną inteligencją, które przechodzą przez system prawny. Te sprawy dotyczą różnych problemów, w tym sporów o prawa autorskie, propagowania szkodliwych treści i przypadków dyskryminacji.
Wśród tych spraw były pozwy złożone przez artystów, którzy oskarżyli deweloperów modeli głębokiego uczenia i tekst-to-obraz, takich jak Stable Diffusion i Midjourney, o wykorzystanie ich sztuki cyfrowej w szkoleniu sztucznej inteligencji bez zgody. Utrzymywali, że firmy za tymi produktami zebrały miliardy obrazów z internetu, w tym ich, aby nauczyć modeli tworzenia własnych obrazów.
W grudniu 2023 roku główna amerykańska gazeta The New York Times weszła w te bitwy prawne, pozywając OpenAI, dewelopera założyciela ChatGPT, o naruszenie praw autorskich. Pozew podkreślił, że miliony artykułów opublikowanych przez organizacje medialne zostały wykorzystane do szkolenia automatycznych czatbotów, które teraz rywalizują z wydawnictwem jako źródło wiarygodnych informacji.
Przyszłe problemy
W odpowiedzi na te pilne obawy, rządy na całym świecie łączą się, aby przeciwstawić się publicznym lękom. Na przykład, przedstawiciele z dwunastu organów regulacyjnych na całym świecie wydali oświadczenie w sierpniu 2023 roku, skupiając się na scrappingu danych i ochronie prywatności. Oświadczenie pochodziło od władz w Argentynie, Australii, Kanadzie, Kolumbii, Hongkongu, Jersey, Meksyku, Maroku, Nowej Zelandii, Norwegii, Szwajcarii i Wielkiej Brytanii. Tymczasem w Kalifornii, ustawa Delete Act została podpisana w prawo, skupiając się na pośrednikach danych i ustanawiając dodatkowe regulacje dotyczące zbierania i zarządzania danymi osobistymi.
Pomimo podejmowanych wysiłków, przewiduję, że obawy dotyczące prywatności i własności danych będą nadal dominować w publicznej debacie w 2024 roku i w przyszłości. Co więcej, wzrost pozwów dotyczących praw autorskich sygnalizuje tylko wierzchołek góry lodowej. Prawdopodobnie będziemy świadkami wzrostu przypadków skupiających się na dokładności i bezpieczeństwie danych, szczególnie wśród powszechnego rozprzestrzeniania się deepfake’ów i dezinformacji.
Podczas gdy zarówno sektor rządowy, jak i biznesowy muszą podwoić swoje wysiłki, niezbędne jest podejście z rozwagą. Pomimo rosnących obaw, warto zauważyć, że otwarte dane nadal odgrywają kluczową rolę w napędzaniu badań i rozwoju. Weźmy na przykład niezwykle ważną rolę publicznego dostępu do kartotek zdrowia podczas kryzysu COVID-19, który przyspieszył rozwój przełomowych odkryć medycznych, takich jak szczepionki opracowane przez Modernę i Pfizer.
Znaczenie otwartych danych podkreśla historyczny przykład amerykańskiego Projektu Ludzkiego Genomu, gdzie publiczne udostępnianie danych genowych przekształciło badania genetyczne. W podobny sposób, sztuczna inteligencja analizująca i ucząca się na danych może przynieść korzyści społeczeństwu, od klasyfikowania mutacji genetycznych po rozwiązywanie pilnych wyzwań, takich jak zmiana klimatu.
W biznesie, dane zebrane przez web scraper’y są niezwykle cenne dla wywiadu rynkowego, śledzenia konkurencji i rozpoznawania dominujących trendów. Jeśli web scraping stanie się bardziej ograniczony, firmy mogą mieć ograniczony dostęp do istotnych danych, co może prowadzić do zmniejszonej konkurencji i przejrzystości w cenach, zahamowania innowacji i gorszego doświadczenia użytkownika z powodu wolniejszych i mniej dokładnych aktualizacji danych.
Jednak pomimo tych rosnących wyzwań, istnieją sposoby, aby im przeciwstawić się. Pokładam nadzieję w mocy proxy, aby nawigować w tych burzliwych wodach. Te innowacyjne technologie ukrywają oryginalne adresy IP użytkowników, kierując ich aktywność online przez alternatywne serwery. Nie tylko wzmacniają bezpieczeństwo danych, ale także stają się niezastąpionymi narzędziami w harmonizowaniu postępu technologicznego z ochroną wolności jednostek.












