Thought leaders

Wie Beschermt Ons Tegen AI-Gegenerede Desinformatie?

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Generatieve AI is in minder dan een jaar van nul naar honderd gegaan. Hoewel het nog vroeg is, heeft het zijn potentieel getoond om bedrijven te transformeren. Daar zijn we het allemaal over eens. Waar we van mening verschillen, is hoe we de gevaren die het met zich meebrengt, kunnen beteugelen.

Om duidelijk te zijn, ik ben voorstander van innovatie en absoluut geen angstzaaier. Maar de recente toename van desinformatie – voornamelijk gericht op polarisatie rondom omstreden kwesties van het moment – heeft het duidelijk gemaakt dat, als het ongecontroleerd blijft, geniale AI een ravage kan aanrichten in samenlevingen.

We hebben deze film eerder gezien met sociale media, maar het duurde jaren en harde lessen voordat we wakker werden voor zijn fouten. We hebben (vermoedelijk) iets geleerd. De vraag vandaag is wie zal helpen om de vloedgolf van realiteitsvervorming van geniale AI tegen te houden, en hoe?

Voorspelbaar genoeg beginnen overheden nu te handelen. Europa neemt de leiding, zoals ze steeds vaker doen bij het reguleren van technologie. De VS zit er recht achter, met President Biden die vorige oktober een uitvoerend bevel uitvaardigde.

Maar het zal een globale inspanning vergen om “geniale AI eerlijk” te houden. En voordat de overheid kan helpen, moet ze de beperkingen van de beschikbare benaderingen begrijpen.

Het identiteitsprobleem is een stuk erger geworden

In deze nieuwe wereld wordt de waarheid de naald in een hooiberg van meningen die zich voordoen als feiten. Het is belangrijk om te te weten wie de inhoud afkomstig is.

En het is niet zo eenvoudig als te bepalen dat elk sociaal mediaprofiel identiteitsgeverifieerd moet zijn. Er is hevige tegenstand tegen, en in sommige gevallen is anoniemheid nodig om profielen te beschermen. Bovendien bekommeren veel consumenten van de slechtste inhoud zich niet om de geloofwaardigheid, noch waar het vandaan komt.

Ondanks die kanttekeningen, wordt de potentiële rol van identiteit in het omgaan met geniale AI onderschat. Skeptici, hoor me aan.

Laten we ons voorstellen dat regulering of sociaal geweten platforms ertoe brengen om elke accounthouder de volgende keuzes te geven:

  1. Verifieer uw identiteit of niet, en
  2. Toon uw geverifieerde identiteit openbaar, of alleen als “ID Geverifieerd” gelabeld

Dan kan het sociale mediapubliek beter bepalen wie geloofwaardig is. Even belangrijk, zo niet nog belangrijker, ondersteunt identiteit aansprakelijkheid. Platforms kunnen beslissen over acties tegen serieuze “desinformatoren” en herhaalde misbruikers van AI-gegenereerde inhoud, zelfs als ze onder verschillende accountnamen opduiken.

Met geniale AI die de inzet verhoogt, geloof ik dat identiteit – weten wie precies wat heeft gepost – essentieel is. Sommigen zullen het tegenhouden, en identiteit is geen alomvattende oplossing. In feite zal geen enkele oplossing alle belanghebbenden tevreden stellen. Maar als regulering platforms ertoe brengt om identiteitsverificatie aan te bieden aan alle accounts, ben ik ervan overtuigd dat de impact een enorme positieve zal zijn.

De moderatie-dilemma

Inhoudsmoderatie – zowel geautomatiseerd als door mensen – is de laatste verdedigingslinie tegen ongewenste inhoud. Menselijke moderatie is een moeilijke taak, met het risico van psychische schade door blootstelling aan het slechtste dat de mensheid te bieden heeft. Het is ook duur en vaak beschuldigd van de bevooroordeelde censuur die platforms proberen terug te dringen.

Geautomatiseerde moderatie gaat verder dan de capaciteit van mensen om de tsunami van nieuwe inhoud te verwerken, maar het faalt om context (memes zijn een veelvoorkomend voorbeeld) en culturele nuances te begrijpen. Beide vormen van moderatie zijn cruciaal en noodzakelijk, maar ze zijn slechts een deel van het antwoord.

Het vaak gehoorde, conventionele recept voor het controleren van geniale AI is: “Samenwerking tussen technologie-leiders, overheid en civiele samenleving is nodig.” Zeker, maar wat specifiek?

Overheden, voor hun part, kunnen sociale en media-platforms aanzetten om identiteitsverificatie en prominent aan te geven op alle berichten. Regulatoren kunnen ook de weg vrijmaken voor geloofwaardigheidsmetrieken die daadwerkelijk helpen bij het bepalen of een bron geloofwaardig is. Samenwerking is noodzakelijk om universele standaarden te ontwikkelen die specifieke richtlijnen en richting geven, zodat de private sector niet hoeft te raden.

Tenslotte, zou het illegaal moeten zijn om kwaadaardige AI-uitvoer te creëren? Wetgeving om inhoud te verbieden die bedoeld is voor illegale activiteit, kan het volume van giftige inhoud verlagen en de last op moderators verlichten. Ik zie regulering en wetten niet als in staat om desinformatie te verslaan, maar ze zijn essentieel in de strijd ertegen.

De zonnige kant van de straat: innovatie

De belofte van innovatie maakt me een optimist hier. We kunnen niet verwachten dat politici of platform-eigenaren ons volledig beschermen tegen AI-gegenereerde misleiding. Ze laten een grote kloof achter, en dat is precies wat de uitvinding van nieuwe technologie zal inspireren om inhoud te authentiseren en nepheid te detecteren.

Nu we de nadelen van sociale media kennen, zijn we snel tot het besef gekomen dat geniale AI een enorme netto-negatief voor de mensheid kan zijn, met zijn vermogen om te polariseren en te misleiden.

Optimistisch gezien, zie ik voordelen in een aanpak met meerdere onderdelen, waar controlemethoden samenwerken, eerst bij de bron, door de creatie van inhoud die bedoeld is voor illegaal gebruik te beperken. Vervolgens, voordat het wordt gepubliceerd, door de identiteit van degenen die anoniemheid weigeren te verifiëren. Vervolgens, duidelijke labeling om geloofwaardigheidsbeoordelingen en de identiteit van de poster of het ontbreken daarvan aan te geven. Tenslotte kunnen geautomatiseerde en menselijke moderatie enkele van de slechtste filters uitfilteren. Ik verwacht dat nieuwe authenticatietechnologie binnenkort online komt.

Als we alles bij elkaar optellen, zullen we een veel betere, maar nooit perfecte, oplossing hebben. Ondertussen moeten we onze vaardigheden ontwikkelen om te bepalen wat echt is, wie de waarheid spreekt en wie ons probeert te bedriegen.

Jeff Sakasegawa is Persona’s Trust & Safety Architect. With over a decade of experience in the Trust & Safety space across companies such as Google, Facebook, Square, and Sift, Jeff is an expert on Risk Management and Compliance. He is passionate about ensuring safe online experiences for all users.