Etikk
Google avslører bruk av offentlig nettinformasjon i AI-trening

I en nylig oppdatering av sin personvernpolicy har Google (GOOGL ) åpent innrømmet å bruke offentlig tilgjengelig informasjon fra nettet til å trene sine AI-modeller. Denne avsløringen, som ble oppdaget av Gizmodo, omfatter tjenester som Bard og Cloud AI. Google-talsperson Christa Muldoon uttalte til The Verge at oppdateringen bare klargjør at nyere tjenester som Bard også er inkludert i denne praksisen, og at Google inkorporerer personvernsprinsipper og -sikkerhet i utviklingen av sine AI-teknologier.
Gjennomsiktighet i AI-trening er et skritt i riktig retning, men det reiser også en rekke spørsmål. Hvordan sikrer Google personvernet til enkeltpersoner når de bruker offentlig tilgjengelig data? Hvilke tiltak er på plass for å forhindre misbruk av denne dataen?
Konsekvensene av Googles AI-treningmetoder
Den oppdaterte personvernpolicyen fastslår nå at Google bruker informasjon for å forbedre sine tjenester og for å utvikle nye produkter, funksjoner og teknologier som er til nytte for brukerne og allmennheten. Politikken spesifiserer også at selskapet kan bruke offentlig tilgjengelig informasjon for å trene Googles AI-modeller og bygge produkter og funksjoner som Google Translate, Bard og Cloud AI-kapasiteter.
Men politikken klargjør ikke hvordan Google vil forhindre at opphavsrettslig beskyttede materialer blir inkludert i datapotten som brukes for trening. Mange offentlig tilgjengelige nettsider har politikker som forbød datainnsamling eller webscraping for å trene store språkmodeller og andre AI-verktøy. Denne tilnærmingen kan potensielt komme i konflikt med globale reguleringer som GDPR som beskytter mennesker mot at deres data misbrukes uten deres uttrykkelige tillatelse.
Bruken av offentlig tilgjengelig data for AI-trening er ikke i seg selv problematisk, men det blir det når det krenker opphavsrettslover og enkeltpersoners personvern. Det er en ømtålig balanse som selskaper som Google må navigere forsiktig.
Den bredere innvirkningen av AI-treningpraksis
Bruken av offentlig tilgjengelig data for AI-trening har vært et omstridt tema. Populære generative AI-systemer som OpenAI sin GPT-4 har vært tilbakeholdne med hensyn til deres datasårer, og om de inkluderer sosiale medieinnlegg eller opphavsrettslig beskyttede verk av menneskelige kunstnere og forfattere. Denne praksisen befinner seg for tiden i et juridisk gråområde, og det har utløst flere søksmål og fått lovgivere i noen nasjoner til å innføre strengere lover for å regulere hvordan AI-selskaper samler inn og bruker deres treningsdata.
Den største avisutgiveren i USA, Gannett, saksøker Google og dets morselskap, Alphabet (GOOG ), og hevder at fremgangen i AI-teknologi har hjulpet søkemotoren til å holde et monopol over det digitale annonsemarkedet. I mellomtiden har sosiale plattformer som Twitter og Reddit tatt tiltak for å forhindre andre selskaper fra å fritt innsamle deres data, noe som har ført til en reaksjon fra deres respektive samfunn.
Disse utviklingene understreker behovet for robuste etiske retningslinjer for AI. Ettersom AI fortsetter å utvikle seg, er det avgjørende for selskaper å balansere teknologisk fremgang med etiske overveielser. Dette inkluderer å respektere opphavsrettslover, beskytte enkeltpersoners personvern og sikre at AI er til nytte for hele samfunnet, ikke bare et utvalg.
Googles nylige oppdatering av sin personvernpolicy har kastet lys over selskapets AI-treningpraksis. Men det reiser også spørsmål om de etiske implikasjonene av å bruke offentlig tilgjengelig data for AI-trening, den potensielle krenkelsen av opphavsrettslover og innvirkningen på brukernes personvern. Ettersom vi går videre, er det essensielt for oss å fortsette denne samtalen og arbeide mot en fremtid der AI utvikles og brukes på en ansvarlig måte.












