Thought leaders
Waarom gegevensbescherming het definiÃŦrende technische onderwerp van 2024 zal zijn
In de schijnwerpers van de technische wereld trekken AI-gestuurde chatbots zoals ChatGPT de aandacht, waardoor industrieÃŦn opnieuw worden ingericht. Met elke vooruitgang verdwijnen traditionele rollen in de vergetelheid â schrijvers, marketinggurus, zelfs IT-experts vinden zichzelf op de snijlijn. Alleen in juni 2023 verloren 3.900 Amerikanen hun banen aan AI. Deze verstoring is echter slechts een voorbode van wat nog komen gaat.
Terwijl AI zijn veroveringen voortzet in verschillende industrieÃŦn, groeit de bezorgdheid over auteursrechtschendingen en gegevenslekken. De vraag rijst: hoe kunnen we een delicate balans tussen vooruitgang en gegevensbescherming waarborgen?
vonken van bezorgdheid
Om te beginnen, zal ik uitleggen hoe AI-modellen zoals ChatGPT functioneren. Ze genereren resultaten op basis van de gegevens die ze tijdens de training leren. Als het model tekst kan produceren die lijkt op die van Shakespeare in de oude Engelse literatuurstijl, betekent dit dat het die inhoud al heeft âgezienâ tijdens de voorbereidingsperiode, voordat het werd vrijgegeven.
Feitelijk zijn de machine learning (ML)-algoritmen achter elk AI-model getraind op enorme hoeveelheden gegevens om goed te presteren. Er zijn bijvoorbeeld systemen die artsen helpen bij diagnostiek â ze analyseren CT-scans en vinden afwijkingen die specifieke ziektes zoals longkanker kunnen aanduiden. Deze systemen worden meestal getraind op miljoenen medische beelden. Zonder die beelden zouden ze geen artefacten op scans kunnen herkennen.
Naarmate de vraag naar AI-hulpmiddelen exponentieel toeneemt, verzamelen technologiebedrijven steeds meer gegevens om hun modellen te trainen. En soms omvat die gegevens gevoelige informatie over personen en organisaties. Bovendien wordt deze gegevens vaak verkregen door miljoenen webpaginaâs te scannen zonder enige overeenkomst met de eigenaren.
Dit wekt publieke bezorgdheid over gegevensbescherming, transparantie en controle over persoonlijke gegevens op internet. Een onderzoek van Deloitte uit 2023 toonde aan dat de meerderheid van de respondenten meer bescherming en controle over hun gegevens wil. Bijna negen van de tien wilden hun verzamelde gegevens kunnen bekijken en verwijderen, en 80% vond dat ze compensatie verdienen als bedrijven winst maken uit hun gegevens. In de VS alleen zijn burgers meer bezorgd over hoe hun gegevens worden gebruikt, met ongeveer zeven van de tien Amerikaanse volwassenen (71%) die deze bezorgdheid delen, tegenover 64% in 2019.
Rechtzaken
Bovendien nemen sommige organisaties deze kwesties voor de rechter. Volgens Fortune waren er meer dan 100 AI-gerelateerde rechtszaken in november 2023 in de rechtssystemen. Deze zaken omvatten een reeks bezorgdheden, waaronder intellectuele eigendomsdisputen, de verspreiding van schadelijke inhoud en gevallen van discriminatie.
Onder deze zaken waren er rechtszaken aangespannen door artiesten die ontwikkelaars van deep learning- en tekst-naar-afbeeldingmodellen zoals Stable Diffusion en Midjourney beschuldigden van het gebruik van hun digitale kunst in AI-training zonder toestemming. Zij betoogden dat de bedrijven achter deze producten miljarden afbeeldingen van het internet hadden verzameld, waaronder de hunne, om modellen te trainen in het genereren van hun eigen afbeeldingen.
In december 2023 voegde de grote Amerikaanse krant The New York Times zich bij deze rechtzaken door OpenAI, de ontwikkelaar achter de bloeiende ChatGPT, aan te klagen wegens auteursrechtschending. De aanklacht benadrukte dat miljoenen artikelen die door mediabedrijven waren gepubliceerd, waren gebruikt om geautomatiseerde chatbots te trainen, die nu de nieuwsuitgeverij als een betrouwbare informatiebron naar de kroon steken.
Toekomstige problemen
Als reactie op deze dringende bezorgdheden komen regeringen over de hele wereld samen om publieke angsten te confronteren. Zo hebben vertegenwoordigers van twaalf wereldwijde regelgevende instanties een gezamenlijke verklaring uitgegeven in augustus 2023, met de focus op gegevensscraping en gegevensbescherming. Deze verklaring kwam van autoriteiten in ArgentiniÃŦ, AustraliÃŦ, Canada, Colombia, Hongkong, Jersey, Mexico, Marokko, Nieuw-Zeeland, Noorwegen, Zwitserland en het VK. Ondertussen werd in CaliforniÃŦ de Delete Act aangenomen als wet, gericht op gegevensmakelaars en het vaststellen van aanvullende regels voor de verzameling en het beheer van persoonlijke gegevens.
Ondanks de geconcerteerde inspanningen, voorzie ik dat gegevensbescherming en eigendomsbezorgdheden hun prominentie in het publieke discours zullen behouden in 2024 en daarna. Bovendien geeft de golf van intellectuele eigendomsrechtszaken slechts het topje van de ijsberg aan. We zullen waarschijnlijk een toename zien in zaken die zich richten op gegevensnauwkeurigheid en -veiligheid, met name te midden van de wijdverbreide verspreiding van deepfakes en desinformatie.
Terwijl zowel de overheid als het bedrijfsleven hun inspanningen moeten verdubbelen, is een voorzichtige aanpak essentieel. Ondanks de toenemende bezorgdheid is het de moeite waard om op te merken dat open gegevens een cruciale rol spelen bij het stimuleren van onderzoek en ontwikkeling. Neem bijvoorbeeld de waardevolle rol die open toegang tot gezondheidsgegevens speelde tijdens de COVID-19-crisis, waardoor de ontwikkeling van levensreddende medische doorbraken zoals de vaccins van Moderna en Pfizer kon worden versneld.
De belangrijkheid van open gegevens wordt onderstreept door het historische voorbeeld van het Amerikaanse Human Genome Project, waarbij het delen van gengegevens de genetica-onderzoek veranderde. Op soortgelijke wijze kan AI die gegevens analyseert en leert, de samenleving ten goede komen, van het categoriseren van genetische mutaties tot het aanpakken van dringende uitdagingen zoals klimaatverandering.
In het bedrijfsleven zijn de gegevens die door web scrapers worden verzameld, onmisbaar voor marktinzicht, concurrerende tracking en het herkennen van dominante trends. Als web scraping wordt beperkt, kunnen bedrijven beperkte toegang hebben tot vitale gegevens voor het nemen van geÃŊnformeerde beslissingen, wat kan leiden tot verminderde concurrentie en transparantie in prijzen, het belemmeren van innovatie en een minder goede gebruikerservaring vanwege langzamere en minder nauwkeurige gegevensupdates.
Toch, te midden van deze groeiende uitdagingen, zijn er manieren om ze rechtstreeks aan te pakken. Ik heb vertrouwen in de kracht van proxies om deze woelige wateren te navigeren. Deze innovatieve technologieÃŦn verhullen de oorspronkelijke IP-adressen van gebruikers, waardoor hun online activiteiten via alternatieve servers worden gekanaald. Ze versterken niet alleen de gegevensbeveiliging, maar komen ook tevoorschijn als onmisbare hulpmiddelen bij het harmoniseren van technologische vooruitgang met de bescherming van individuele vrijheden.












