Andersons hoek

Google heeft de training van deepfakes in Colab verboden

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Op een bepaald moment in de afgelopen twee weken heeft Google stilzwijgend de voorwaarden voor zijn Colab-gebruikers gewijzigd, met een bepaling toegevoegd dat Colab-diensten niet langer mogen worden gebruikt om deepfakes te trainen.

De update van mei brengt een deepfake-verbod naar Colab. Bron: https://research.google.com/colaboratory/faq.html#limitations-and-restrictions

De update van mei brengt een deepfake-verbod naar Colab. Bron: https://research.google.com/colaboratory/faq.html#limitations-and-restrictions

De eerste web-gearchiveerde versie van het Internet Archive die het deepfake-verbod bevat, werd opgenomen op dinsdag 24 mei. De laatste opgenomen versie van de Colab-FAQ die het verbod niet vermeldt, was op 14 mei.

Van de twee populaire deepfake-creatie-distributies, DeepFaceLab (DFL) en FaceSwap, die beide forks zijn van de omstreden en anonieme code die in 2017 op Reddit werd gepost, lijkt alleen de meer beruchte DFL rechtstreeks door het verbod te zijn getroffen. Volgens deepfake-ontwikkelaar ‘chervonij’ op de DFL-Discord, produceert het uitvoeren van de software in Google Colab nu een waarschuwing:

‘U kunt code uitvoeren die niet is toegestaan, en dit kan uw vermogen om Colab in de toekomst te gebruiken beperken. Neem nota van de verboden acties die in onze FAQ zijn gespecificeerd.’

Echter, interessant genoeg, wordt de gebruiker momenteel toegestaan om de uitvoering van de code voort te zetten.

De nieuwe waarschuwing die DFL-deepfakers begroette die de code op Google Colab probeerden uit te voeren. Bron: https://discord.com/channels/797172242697682985/797391052042010654/979823182624219136

De nieuwe waarschuwing die DFL-deepfakers begroette die de code op Google Colab probeerden uit te voeren. Bron: https://discord.com/channels/797172242697682985/797391052042010654/979823182624219136

Volgens een gebruiker in de Discord voor de rivaliserende distributie FaceSwap, lijkt de code van dat project nog niet de waarschuwing te activeren, wat suggereert dat de code voor DeepFaceLab (ook de voedingsarchitectuur voor real-time deepfake-streaming-implementatie DeepFaceLive), veruit de meest dominante deepfakes-methode, specifiek door Colab is getarget.

FaceSwap-co-lead-ontwikkelaar Matt Tora merkte op*:

‘Ik vind het heel onwaarschijnlijk dat Google dit doet om ethische redenen, maar meer omdat Colab bedoeld is voor studenten, datawetenschappers en onderzoekers om computatie-intensieve GPU-code uit te voeren op een gemakkelijke en toegankelijke manier, zonder kosten. Echter, ik vermoed dat een niet onaanzienlijk aantal gebruikers deze bron exploiteert om deepfake-modellen te creëren, op grote schaal, wat zowel computatie-intensief is als een aanzienlijke trainingsduur vereist om resultaten te produceren.

‘Je zou kunnen zeggen dat Colab meer naar de educatieve, onderzoeksgerichte kant van AI neigt. Het uitvoeren van scripts die weinig gebruikersinput of begrip vereisen, gaat in tegen deze richting. Bij FaceSwap proberen we ons te focussen op het onderwijzen van de gebruiker in AI en de mechanismen die daarbij betrokken zijn, terwijl we de drempel naar toegang verlagen. We moedigen ethisch gebruik van de software aan en vinden dat het beschikbaar stellen van deze tools aan een bredere doelgroep mensen helpt te begrijpen wat er vandaag de dag mogelijk is, in plaats van het voor een selecte groep verborgen te houden.

‘Helaas kunnen we niet controleren hoe onze tools uiteindelijk worden gebruikt, noch waar ze worden uitgevoerd. Het spijt me dat een mogelijkheid is afgesloten voor mensen om onze code te experimenteren, maar in termen van het beschermen van deze bron om ervoor te zorgen dat deze beschikbaar blijft voor de daadwerkelijke doelgroep, vind ik het begrijpelijk.’

Er is geen bewijs dat de nieuwe beperking alleen van toepassing is op de gratis laag van Google Colab – onderaan de lijst met verboden activiteiten waaraan deepfakes nu zijn toegevoegd, staat de opmerking ‘Aanvullende beperkingen bestaan voor betaalde gebruikers’, wat aangeeft dat dit basisregels zijn. Met betrekking tot het deepfake-verbod, heeft dit enkelen verward, aangezien ‘cryptocurrency-mijnbouw’ en ‘deelname aan peer-to-peer-bestandsdeling’ zijn opgenomen in zowel de gratis als de pro-‘Beperkingen’-sectie.

Volgens die logica is alles wat in de gratis ‘Beperkingen’-sectie is verboden, toegestaan in de Pro-versie, zolang de Pro-versie het niet uitdrukkelijk verbiedt, waaronder ‘uitvoeren van denial-of-service-aanvallen‘ en ‘wachtwoordkraken’. De aanvullende beperkingen voor de Pro-laag hebben voornamelijk betrekking op het niet ‘onderverhuren’ van Pro-Colab-toegang, ondanks de verwarrende en selectieve dubbele verboden.

Google Colab is een speciale implementatie van Jupyter-notebook-omgevingen, die het mogelijk maken om machine learning-projecten op afstand te trainen op veel krachtigere GPUs dan veel gebruikers zich kunnen veroorloven.

Aangezien deepfake-training een VRAM-hongerige onderneming is, en aangezien de komst van de GPU-schaarste, hebben veel deepfakers in de afgelopen jaren de voorkeur gegeven aan afstands-training in Colab, waar het, afhankelijk van de kans en laag, mogelijk is om een deepfake-model te trainen op krachtige kaarten zoals de Tesla T4 (16GB VRAM, momenteel ongeveer $2k USD), de V100 (32GB VRAM, ongeveer $4k USD), en de machtige A100 (80GB VRAM, MSRP van $32,097.00), onder andere.

Het verbod op Colab-training lijkt waarschijnlijk de pool van deepfakers die hogeresolutie-modellen kunnen trainen te verkleinen, waar de invoer- en uitvoer-afbeeldingen groter zijn, meer geschikt voor hoogresolutie-resultaten en in staat om meer gezichtsdetails te extraheren en te reproduceren.

Sommige van de meest toegewijde deepfake-hobbyisten en enthousiastelingen, volgens Discord- en forumberichten, hebben zwaar geïnvesteerd in lokale hardware in de afgelopen paar jaar, ondanks de hoge prijzen van GPUs.

Echter, gezien de hoge kosten die hierbij zijn gemoeid, zijn subgemeenschappen ontstaan om de uitdagingen van het trainen van deepfakes op Colabs aan te pakken, waarbij de meest voorkomende klacht sinds Colab de toegang tot hogere-end-GPUs voor gratis gebruikers heeft beperkt.

 

* In privéberichten op Discord

Eerst gepubliceerd op 28 mei 2022.
Herzien om 7:28 AM EST, correctie van quotatypfout.
Herzien om 12:40 PM EST – toegevoegde verduidelijking met betrekking tot gratis en pro-laag deepfake-verboden, zoals het best kan worden begrepen uit de ‘gratis’ en ‘pro’-lijsten van verboden.

Schrijver over machine learning, domeinspecialist in humane beeldsynthese. Voormalig hoofd van onderzoeksinhoud bij Metaphysic.ai, tot de opheffing ervan in DNEG's Brahma.ai.
Portfolio site: martinanderson.ai
Contact: martin@martinanderson.ai