Andersons vinkel

Google har forbudt trening av deepfakes i Colab

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Noen gang i løpet av de siste to ukene har Google quiett endret betingelsene for sine Colab-brukere, og lagt til en bestemmelse som sier at Colab-tjenestene ikke lenger kan brukes til å trene deepfakes.

Mai-opdateringen bringer et deepfake-forbud til Colab. Kilde: https://research.google.com/colaboratory/faq.html#limitations-and-restrictions

Mai-opdateringen bringer et deepfake-forbud til Colab. Kilde: https://research.google.com/colaboratory/faq.html#limitations-and-restrictions

Den første web-arkiverte versjonen fra Internet Archive som inneholder deepfake-forbudet, ble fanget sist tirsdag, den 24. mai. Den siste fanget versjonen av Colab-FAQ som ikke nevner forbudet, var den 14. mai.

Av de to mest populære deepfake-oppsettene, DeepFaceLab (DFL) og FaceSwap, som begge er fork av den kontroversielle og anonyme koden som ble postet på Reddit i 2017, synes bare det mer notoriske DFL å ha blitt direkte rammet av forbudet. Ifølge deepfake-utvikler ‘chervonij’ på DFL Discord, produserer kjøring av programvaren i Google Colab nå en advarsel:

‘Du kan være i ferd med å kjøre kode som ikke er tillatt, og dette kan begrense din evne til å bruke Colab i fremtiden. Vær oppmerksom på de forbudte handlingene som er spesifisert i vår FAQ.’

Men, interessant nok, er brukeren for tiden tillatt å fortsette med kjøringen av koden.

Den nye advarselen som møtte DFL-deepfakers som prøvde å kjøre koden på Google Colab. Kilde: https://discord.com/channels/797172242697682985/797391052042010654/979823182624219136

Den nye advarselen som møtte DFL-deepfakers som prøvde å kjøre koden på Google Colab. Kilde: https://discord.com/channels/797172242697682985/797391052042010654/979823182624219136

Ifølge en bruker i Discord for rivaliserende distribusjon FaceSwap, synes prosjektets kode å ikke utløse advarselen, noe som tyder på at koden for DeepFaceLab (som også er arkitekturen for sanntids deepfake-strømming implementering DeepFaceLive), som er den mest dominante deepfakes-metoden, har blitt spesifikt rammet av Colab.

FaceSwap co-lead-utvikler Matt Tora kommenterte*:

‘Jeg finner det svært usannsynlig at Google gjør dette av noen spesielle etiske årsaker, mer at Colabs grunnleggende årsak er for studenter/dataforskere/forskere å kunne kjøre datamaskinelt kostbare GPU-koder på en enkel og tilgjengelig måte, uten kostnad. Men, jeg mistenker at en ikke ubetydelig mengde brukere utnytter denne ressursen til å lage deepfake-modeller, i stor skala, noe som er både datamaskinelt kostbart og tar en ikke ubetydelig mengde treningstid å produsere resultater.

‘Du kunne si at Colab heller mot den pedagogiske, forskningsbaserte siden av AI. Kjøring av skript som krever liten brukerinput, eller forståelse, går mot denne. Hos FaceSwap prøver vi å fokusere på å utdanne brukeren i AI og de mekanismer som er involvert, samtidig som vi senker terskelen for inngang. Vi oppmuntrer sterkt til etisk bruk av programvaren og føler at å gjøre disse verktøyene tilgjengelige for en bredere publikum hjelper med å utdanne folk om hva som er mulig i dagens verden, snarere enn å holde det skjult for et utvalg få.

‘Uheldigvis kan vi ikke kontrollere hvordan våre verktøy ultimate brukes, eller hvor de kjøres. Det bedrører meg at en åpning har blitt stengt for folk til å eksperimentere med vår kode, men i forhold til å beskytte denne ressursen for å sikre dens tilgjengelighet til den faktiske målgruppen, finner jeg det forståelig.’

Det er ingen bevis for at den nye restriksjonen bare er begrenset til den gratis versjonen av Google Colab – på bunnen av listen over forbudte aktiviteter som deepfakes nå er lagt til, er notatet ‘Ekstra restriksjoner eksisterer for betalte brukere’, noe som indikerer at disse er basisregler. I forhold til deepfakes-forbudet, har dette forvirret noen, siden ‘kryptovaluta-utvinning’ og ‘deltagelse i peer-to-peer-fildeling’ er inkludert i både den gratis og pro-versjonen av ‘Restriksjoner’-seksjonen.

Etter denne logikken, er alt som er forbudt i den gratis ‘Restriksjoner’-seksjonen tillatt i Pro-versjonen, så lenge Pro-versjonen ikke uttrykkelig forbudet, inkludert ‘kjøring av nekt-å-tjene-angrep’ og ‘passord-knusing’. De ekstra restriksjonene for Pro-nivået er hovedsakelig opptatt av å ikke ‘underleie’ Pro Colab-tilgang, til tross for de forvirrende og selektive duplikate-forbudene.

Google Colab er en dedikert implementering av Jupyter notebook-miljøer, som tillater fjernetrening av maskinlæringsprosjekter på langt kraftigere GPU-er enn mange brukere kan betale for.

Siden deepfake-trening er en VRAM-sulten aktivitet, og siden begynnelsen av GPU-famen, har mange deepfakers i de siste årene forkastet hjemmetrening til fordel for fjernetrening i Colab, hvor det er mulig, avhengig av sjansen og nivå, å trene en deepfake-modell på kraftige kort som Tesla T4 (16GB VRAM, for tiden rundt 2 000 USD), V100 (32GB VRAM, rundt 4 000 USD), og den mektige A100 (80GB VRAM, MSRP på 32 097,00 USD), blant andre.

Forbudet mot Colab-trening synes sannsynlig å redusere bassen av deepfakers som kan trene høyoppløselige modeller, hvor inn- og utgangsbildene er større, mer egnet for høyoppløselige resultater, og i stand til å trekke ut og gjenskape større ansiktsdetaljer.

Noen av de mest dedikerte deepfake-hobbyistene og entusiastene, ifølge Discord- og forum-innlegg, har investert tungt i lokal maskinvare i løpet av de siste par årene, til tross for de høye prisene på GPU-er.

Men, gitt de høye kostnadene, har undergrupper oppstått for å håndtere utfordringene med å trene deepfakes på Colabs, med tilfeldig GPU-tilordning som det vanligste problemet siden Colab begrenset bruken av høyere-end-GPU-er til gratisbrukere.

 

* I private meldinger på Discord

Først publisert 28. mai 2022.
Revidert 7:28 AM EST, korreksjon av sitat-typoskrift.
Revidert 12:40pm EST – lagt til forklaring om gratis- og pro-nivå-deepfake-forbud, så godt det kan forstås fra ‘gratis’- og ‘pro’-listene over forbud.

Forfatter innen maskinlæring, domenespesialist i menneskeskapesynthese. Tidligere sjef for forskningsinnhold i Metaphysic.ai, til det ble oppløst i DNEG's Brahma.ai.
Portfolio nettsted: martinanderson.ai
Kontakt: martin@martinanderson.ai