Etik
Google Avslöjar Användning av Offentligt Webbinnehåll för AI-utbildning

I en nyligen uppdaterad version av sin integritetspolicy har Google (GOOGL ) öppet medgivit att de använder offentligt tillgänglig information från webben för att utbilda sina AI-modeller. Denna avslöjande, upptäckt av Gizmodo, inkluderar tjänster som Bard och Cloud AI. Google-talesperson Christa Muldoon uppgav till The Verge att uppdateringen enbart förtydligar att nyare tjänster som Bard också omfattas av denna praxis, och att Google införlivar integritetsprinciper och skyddsåtgärder i utvecklingen av sina AI-teknologier.
Transparens i AI-utbildningspraxis är ett steg i rätt riktning, men det väcker också en mängd frågor. Hur säkerställer Google enskilda personers integritet när de använder offentligt tillgänglig data? Vilka åtgärder finns på plats för att förhindra missbruk av denna data?
Implikationerna av Googles AI-utbildningsmetoder
Den uppdaterade integritetspolicyn anger nu att Google använder information för att förbättra sina tjänster och för att utveckla nya produkter, funktioner och teknologier som gynnar användarna och allmänheten. Policyn specificerar också att företaget kan använda offentligt tillgänglig information för att utbilda Googles AI-modeller och bygga produkter och funktioner som Google Translate, Bard och Cloud AI-funktioner.
Men policyn förtydligar inte hur Google ska förhindra att upphovsrättsskyddat material ingår i datamängden som används för utbildning. Många offentligt tillgängliga webbplatser har policys som förbjuder datainsamling eller webbskrapning för utbildning av stora språkmodeller och andra AI-verktyg. Denna metod kan potentiellt strida mot globala regleringar som GDPR som skyddar människor mot missbruk av deras data utan deras uttryckliga tillstånd.
Användningen av offentligt tillgänglig data för AI-utbildning är inte i sig problematisk, men den blir det när den kränker upphovsrättslagar och enskilda personers integritet. Det är en känslig balans som företag som Google måste navigera försiktigt.
Den bredare inverkan av AI-utbildningspraxis
Användningen av offentligt tillgänglig data för AI-utbildning har varit en omstridd fråga. Populära generativa AI-system som OpenAI:s GPT-4 har varit ovilliga att avslöja sina datakällor och om de inkluderar sociala medieinlägg eller upphovsrättsskyddade verk av mänskliga artister och författare. Denna praxis befinner sig för närvarande i ett rättsligt gråområde, vilket har lett till flera rättsfall och har fått lagstiftare i vissa länder att föreslå strängare lagar för att reglera hur AI-företag samlar in och använder sin utbildningsdata.
Den största tidningsförläggaren i USA, Gannett, stämmer Google och dess moderbolag, Alphabet (GOOG ), med påståenden om att framstegen inom AI-teknik har hjälpt sökjätten att hålla en monopolsituation på den digitala annonsmarknaden. Samtidigt har sociala plattformar som Twitter och Reddit vidtagit åtgärder för att förhindra att andra företag fritt samlar in deras data, vilket har lett till reaktioner från deras respektive samhällen.
Dessa utvecklingar understryker behovet av robusta etiska riktlinjer för AI. När AI fortsätter att utvecklas är det avgörande för företag att balansera teknisk utveckling med etiska överväganden. Detta inkluderar att respektera upphovsrättslagar, skydda enskilda personers integritet och säkerställa att AI gynnar hela samhället, inte bara ett fåtal.
Googles nyliga uppdatering av sin integritetspolicy har kastat ljus över företagets AI-utbildningspraxis. Men det väcker också frågor om de etiska implikationerna av att använda offentligt tillgänglig data för AI-utbildning, den potentiella kränkningen av upphovsrättslagar och inverkan på användarintegritet. När vi går vidare är det avgörande för oss att fortsätta denna konversation och arbeta mot en framtid där AI utvecklas och används på ett ansvarsfullt sätt.












