Ethiek
Google onthult het gebruik van openbare webgegevens voor AI-training

In een recente update van het privacybeleid heeft Google (GOOGL ) openlijk toegegeven dat het openbaar beschikbare informatie van het web gebruikt om zijn AI-modellen te trainen. Deze bekendmaking, gespot door Gizmodo, omvat diensten zoals Bard en Cloud AI. Google-woordvoerder Christa Muldoon verklaarde tegenover The Verge dat de update slechts verduidelijkt dat nieuwe diensten zoals Bard ook in deze praktijk zijn opgenomen, en dat Google privacybeginselen en waarborgen integreert in de ontwikkeling van zijn AI-technologieën.
Transparantie in AI-trainingspraktijken is een stap in de goede richting, maar het roept ook een reeks vragen op. Hoe zorgt Google ervoor dat de privacy van individuen wordt gewaarborgd bij het gebruik van openbaar beschikbare gegevens? Welke maatregelen zijn er genomen om misbruik van deze gegevens te voorkomen?
De implicaties van Google’s AI-trainingsmethoden
Het bijgewerkte privacybeleid vermeldt nu dat Google informatie gebruikt om zijn diensten te verbeteren en om nieuwe producten, functies en technologieën te ontwikkelen die zijn gebruikers en het publiek ten goede komen. Het beleid specificeert ook dat het bedrijf openbaar beschikbare informatie kan gebruiken om Google’s AI-modellen te trainen en producten en functies zoals Google Translate, Bard en Cloud AI-mogelijkheden te bouwen.
Het beleid verduidelijkt echter niet hoe Google zal voorkomen dat auteursrechtelijk beschermde materialen worden opgenomen in de gegevenspool die wordt gebruikt voor training. Veel openbaar toegankelijke websites hebben beleid dat gegevensverzameling of webscraping voor het doel van het trainen van grote taalmodellen en andere AI-hulpmiddelen verbiedt. Deze aanpak kan potentieel in conflict komen met mondiale regelgevingen zoals de AVG die mensen beschermen tegen misbruik van hun gegevens zonder hun uitdrukkelijke toestemming.
Het gebruik van openbaar beschikbare gegevens voor AI-training is op zich niet problematisch, maar het wordt wel problematisch wanneer het inbreuk maakt op auteursrechtswetten en individuele privacy. Het is een delicate balans die bedrijven zoals Google zorgvuldig moeten navigeren.
De bredere impact van AI-trainingspraktijken
Het gebruik van openbaar beschikbare gegevens voor AI-training is een omstreden kwestie. Populaire generatieve AI-systemen zoals OpenAI’s GPT-4 zijn terughoudend over hun gegevensbronnen en of ze sociale mediaberichten of auteursrechtelijk beschermde werken van menselijke artiesten en auteurs bevatten. Deze praktijk zit momenteel in een juridische grijze zone, waardoor verschillende rechtszaken ontstaan en wetgevers in sommige landen striktere wetten introduceren om te reguleren hoe AI-bedrijven hun trainingsgegevens verzamelen en gebruiken.
De grootste krantenuitgever in de Verenigde Staten, Gannett, procedeert tegen Google en zijn moederbedrijf, Alphabet (GOOG ), met de claim dat de vooruitgang in AI-technologie de zoekgigant heeft geholpen om een monopolie op de digitale advertentiemarkt te behouden. Ondertussen hebben sociale platforms zoals Twitter en Reddit maatregelen genomen om te voorkomen dat andere bedrijven hun gegevens vrijelijk oogsten, wat leidt tot backlash van hun respectieve gemeenschappen.
Deze ontwikkelingen onderstrepen de noodzaak van robuuste ethische richtlijnen voor AI. Naarmate AI blijft evolueren, is het cruciaal voor bedrijven om technologische vooruitgang te balanceren met ethische overwegingen. Dit omvat het respecteren van auteursrechtswetten, het beschermen van individuele privacy en het waarborgen dat AI ten goede komt aan de hele samenleving, niet alleen aan een selecte groep.
Google’s recente update van het privacybeleid heeft een licht geworpen op de AI-trainingspraktijken van het bedrijf. Het roept echter ook vragen op over de ethische implicaties van het gebruik van openbaar beschikbare gegevens voor AI-training, de potentiële inbreuk op auteursrechtswetten en de impact op gebruikersprivacy. Naarmate we vooruitgaan, is het essentieel om deze conversatie voort te zetten en te werken aan een toekomst waarin AI verantwoord wordt ontwikkeld en gebruikt.












