Tankeledere
Hvorfor datavern vil være 2024s avgjørende teknologi-spørsmål
I teknologiens verden er AI-drevne chatboter som ChatGPT i fokus, og de endrer bransjene vår som vi kjenner dem. Med hver fremgang, forsvinner tradisjonelle roller inn i ubrukelighet – forfattere, markedsføringsguruer, selv IT-eksperter finner seg på nedleggelseslisten. Bare i juni 2023 mistet hele 3 900 amerikanere jobbene sine til AI. Likevel er denne forstyrrelsen bare en forspill til hva som kommer.
Ettersom AI fortsetter sine erobringer over bransjene, vokser en bølge av bekymring når det gjelder opphavsrett og personvernsbrudd. Spørsmålet er stort: hvordan kan vi sikre en fin balanse mellom fremgang og personvern?
Bekymringsgnister
For å begynne med, skal jeg forklare hvordan AI-modeller som ChatGPT fungerer. De genererer resultater basert på data de lærer under trening. Hvis modellen kan lage tekst som ser ut som om den var skrevet av Shakespeare i samme gammel engelsk litterær stil, betyr det at den allerede har “sett” denne innholdet før under forberedelsesperioden, før lanseringen.
I virkeligheten er maskinlæringsalgoritmene (ML) bak hver AI-modell trent på store mengder data for å fungere godt. For eksempel finnes det systemer som hjelper leger med diagnostisering — de analyserer CT-skanninger og finner abnormaliteter som kan indikere bestemte sykdommer som lungekreft. De er vanligvis trent på millioner av medisinske bilder. Uten det kunne de ikke gjenkjenne artefakter på skanninger.
Ettersom etterspørselen etter AI-verktøy øker eksponentielt, samler teknologigigantene stadig større mengder data for å trene modellene sine. Og noen ganger inkluderer denne dataen følsomme opplysninger om personer og organisasjoner. I tillegg hentes denne dataen ofte inn ved å skrape millioner av nettsider uten noen avtaler fra eierne.
Dette fører til offentlige bekymringer om personvern, åpenhet og kontroll over personlige opplysninger på internettet. En undersøkelse fra Deloitte i 2023 avdekket at flertallet av respondentene søker mer beskyttelse og kontroll over hvordan deres data brukes. Nesten ni av ti ønsker å se og slette innhentede data, og 80% føler de fortjener kompensasjon for at selskaper tjener penger på deres data. I USA alene har borgerne blitt mer bekymret for hvordan deres data brukes, med om lag syv av ti voksne (71%) som deler disse bekymringene, opp fra 64% i 2019.
Rettslige kamper
I tillegg tar noen organisasjoner disse problemene til retten. Ifølge Fortune var det, per november 2023, over 100 AI-relaterte søksmål som gikk gjennom rettssystemet. Disse sakene dekker et spekter av bekymringer, inkludert immaterielle rettstvister, spredning av skadelig innhold og tilfeller av diskriminering.
Blant disse sakene var det søksmål innledet av kunstnere som anklaget utviklere av dyptlærings- og tekst-til-bilde-modeller som Stable Diffusion og Midjourney for å bruke deres digitale kunst i AI-trening uten samtykke. De hevdet at selskapene bak disse produktene hadde samlet inn milliarder av bilder fra internettet, inkludert deres egne, for å instruere modellene i å generere sine egne bilder.
I desember 2023 gikk den store amerikanske avisen The New York Times inn i disse rettslige kampene ved å saksøke OpenAI, utvikleren bak den blomstrende ChatGPT, for brudd på opphavsrett. Søksmålet betonte at millioner av artikler publisert av medieorganisasjoner ble brukt til å trene automatiserte chatboter, som nå rivaliserer med nyhetskanalen som en pålitelig kilde til informasjon.
Framtidige problemer
Som respons på disse presserende bekymringene, samler regjeringer over hele verden seg for å møte offentlige bekymringer. For eksempel utstedte representanter fra tolv reguleringssorganer over hele verden en felles uttalelse i august 2023, som fokuserte på datasraping og personvernsbeskyttelse. Uttalelsen kom fra myndigheter i Argentina, Australia, Canada, Colombia, Hongkong, Jersey, Mexico, Marokko, New Zealand, Norge, Sveits og Storbritannia. I mellomtiden ble Delete Act godkjent i California, som retter seg mot databrukerne og etablerer ytterligere reguleringer for personlig datainnsamling og -håndtering.
Til tross for samordnede innsats, forutser jeg at personvern og eierrettighetsproblemer vil beholde sin fremtredende plass i offentlig diskurs gjennom 2024 og utover. I tillegg signaliserer den økende strømmen av immaterielle rettssaker bare toppen av isfjellet. Vi er sannsynligvis å se en økning i saker som fokuserer på dataakkuratheit og -sikkerhet, spesielt blant den rasende spredningen av deepfakes og desinformasjon.
Mens både offentlig og privat sektor må fordoble sine innsats, er en forsiktig tilnærming avgjørende. Til tross for økende bekymringer, er det verdt å merke seg at åpen data fortsatt spiller en avgjørende rolle i å drive forskning og utvikling fremover. Ta for eksempel den uvurderlige rollen offentlig tilgang til helsejournaler spilte under COVID-19-krisen, som akselererte utviklingen av livreddende medisinske gjennombrudd som vaksinene som ble ledet av Moderna og Pfizer.
Betydningen av åpen data understrekes av det historiske eksempelet fra det amerikanske Human Genome-prosjektet, der offentlig deling av gendata transformerte genforskning. På en lignende måte kan AI-analyse og -læring på dataene være til nytte for samfunnet, fra å kategorisere genetiske mutasjoner til å møte presserende utfordringer som klimaendringer.
I næringslivet er data som samles inn av webskrapere uvurderlig for markedskunnskap, konkurrentovervåking og gjenkjenning av rådende trender. Hvis webskraping blir mer begrenset, kan selskaper møte begrensede muligheter for å få tilgang til avgjørende data for å ta informerte beslutninger, potensielt førende til redusert konkurranse og åpenhet i prising, hindring av innovasjon og dårligere brukeropplevelse på grunn av langsommere og mindre nøyaktig dataoppdatering.
Likevel, blant disse voksende utfordringene, finnes det veier å møte dem direkte. Jeg har tillit til kraften i proksyer for å navigere disse turbulente farvannene. Disse innovative teknologiene skjuler brukernes opprinnelige IP-adresser, kanalisering av deres nettaktiviteter gjennom alternative servere. Ikke bare styrker de datasikkerheten, men de oppstår også som uunnværlige verktøy i å harmonisere teknologisk fremgang med beskyttelsen av individuelle friheter.












