Tankeledere
Hvordan bruke generative AI-stemmer etisk i bedrifter i 2023

Slutten av 2022 kom på hælene av AI-teknologier som opplevde vidstrakt bruk på grunn av den slående populariteten til OpenAI og ChatGPT. For første gang oppnådde AI massemarkedets appell ved å bevise sin nytte og verdi i å skape suksessfulle forretningsresultater.
Mange AI-teknologier som synes å være en revolusjon for vanlige mennesker i 2023, har faktisk vært i aktiv bruk av store bedrifter og media i flere år. Bli med meg når jeg tar en nærmere titt på teknologien som driver disse løsningene, spesielt generative AI-systemer for stemmekloning, dens forretningsfordeler og etiske tilnærminger til å bruke AI.
Hvordan fungerer stemmekloning?
Kort sagt, stemmekloning gjør det mulig for en person å snakke med en annen persons stemme.
Den bruker generative AI-teknologi til å lage opptak av en persons stemme og bruke dem til å generere ny lydinnhold med samme persons stemme. Det gjør i praksis det mulig for mennesker å høre hva noen ville ha sagt, selv om de ikke sa det selv.
På den tekniske siden, ser ting ikke ut til å være særlig kompliserte. Men hvis du dykker litt dyptere, er det noen minimumskrav for å komme i gang:
- Du trenger minst 5 minutter med høykvalitetsopptak av kildestemmen for å klone den. Disse opptakene bør være klare og fri for bakgrunnsstøy eller andre forvrengninger, da eventuelle feil kan påvirke nøyaktigheten av modellens utdata.
- Deretter mata disse opptakene inn i en generativ AI-modell for å lage en “stemme-avatarmodell”.
- Deretter trene modellen til å nøyaktig gjenskape talemønster i tone og timing.
- Når dette er fullført, kan den trenede modellen generere ubegrenset innhold med kildestemmen til en annen person, og bli et effektivt verktøy for å skape realistisk lydende stemmekloner.
Dette er punktet hvor mange reiser etiske bekymringer. Hva skjer når vi kan sette inn hvilken som helst tekst i en annen persons munn, og det er umulig å si om ordene er ekte eller falske?
Ja, denne muligheten har lenge siden blitt en realitet. Som i tilfelle med OpenAI og ChatGPT, står vi nå overfor en rekke etiske problemer som ikke kan ignoreres.
Etiske standarder i AI
Som med mange andre nye teknologier i deres innledende fasen, er den største trusselen å skape en negativ stigma rundt teknologien, i stedet for å anerkjenne truslene som en kilde til diskusjon og verdifull kunnskap. Det viktige er å avdekke metodene som dårlige aktører bruker til å misbruke teknologien og dens produkter, anvende mitigasjonsteknikker og fortsette å lære.
I dag har vi tre lag med rammer for etiske standarder i forhold til bruk av generative AI. De nasjonale og overnasjonale reguleringsslagene er i deres innledende utviklingsfase. Politikken kan ikke holde tritt med utviklingstakten til fremvoksende teknologi, men vi kan allerede observere EU som leder med EU-forslag om AI-regulering og 2022-kodeksen for praksis om desinformasjon som fastsetter forventningene til store teknologiselskaper for å takle spredningen av skadelig AI-manipulert innhold. På nasjonalt nivå ser vi reguleringens første skritt av USA og Storbritannia i å håndtere problemet med USAs Nasjonalt deepfake- og digital proveniensarbeidsgruppe og Storbritannias Online Safety Bill.
Teknologibransjens lag beveger seg raskere, ettersom selskaper og teknologer aksepterer denne nye virkeligheten som det gjelder fremvoksende teknologier og deres innvirkning på samfunnssikkerhet og personvern. Dialogen om etikken i generative AI er livlig og har ledet veien mot å utvikle bransjeinitiativer for kodeks om bruk av generative AI (f.eks. The Partnership on AI Synthetic Media Code of Conduct) og etiske uttalelser utgitt av ulike selskaper. Spørsmålet er, hvordan kan vi gjøre oppførselen praktisk? Og, kan de påvirke produkter, bestemte funksjoner og prosedyrer for team?
Etter å ha arbeidet med dette problemet med en rekke ulike medie- og underholdnings-, cybersikkerhets- og AI-etiske samfunn, har jeg formulert noen praktiske prinsipper for å håndtere AI-innhold og stemmer, spesielt:
- Eierne av IP og selskapet som bruker den klonede stemmen kan unngå mange av de potensielle komplikasjonene forbundet med å bruke originalstemmer ved å signere juridiske avtaler.
- Prosjekteiere bør offentliggjøre bruken av en klonet stemme, slik at lyttere ikke blir misledt.
- Selskaper som arbeider med AI-teknologi for stemmer bør allokerer en prosentdel av ressursene til å utvikle teknologi som kan detektere og identifisere AI-generert innhold.
- Merkning av AI-generert innhold med vannmerker muliggjør stemmeautentisering.
- Hvert AI-tjenesteleverandør bør gjennomgå hvert prosjekt av sin innvirkning (sosial, forretnings- og personvernivå) før de samtykker til å arbeide med det.
Selvfølgelig vil prinsippene for etikk i AI ikke påvirke spredningen av hjemmelagde deepfakes på nettet. Men de vil skyve prosjekter i gråsonen ut av rekkevidde for det offentlige markedet.
I 2021-22 ble AI-stemmer brukt i ulike mainstream-prosjekter som introduserte betydelige implikasjoner for etikk og samfunn. Disse inkluderte kloning av young Luke Skywalkers stemme for Mandalorian-serien, AI-stemme for God of War 2, og Richard Nixons stemme for den historiske ‘In Event of Moon Disaster’.
Tilliten til teknologien vokser utover media og underholdning. Tradisjonelle bedrifter over mange bransjer bruker klonede stemmer i sine prosjekter. Her er noen av de mest fremtredende bruksområdene.
Bruksområder i industrien
I 2023 vil stemmekloning fortsette å stige sammen med ulike bedrifter som skal høste dens mange fordeler. Fra helse og markedsføring til kundeservice og reklameindustrien, er stemmekloning revolusjoniserende måten organisasjoner bygger relasjoner med sine kunder og strømlinjeformer sine arbeidsflyter.
Stemme-kloning er til nytte for helsepersonell og sosialarbeidere som arbeider i en nettbasert miljø. Digitale avatarer med samme stemme som medisinske fagpersoner fremmer sterkere bånd mellom dem og pasientene, øker tillit og beholder kunder.
Potensialet for stemmekloning i film- og underholdningsindustrien er stort. Dubbing av innhold til flere språk, barn og voksen ekstra dialoger (ADR) og en nesten uendelig rekke tilpasningsmuligheter er alle mulig med denne teknologien.
Lignende i driftssektoren, kan AI-drevet stemmekloning gi utmerkede resultater for merker som trenger kostnadseffektive løsninger for interaktive talesystemer eller korporative opplæringsvideoer. Med tale-synteseteknologi kan skuespillere utvide sin rekkevidde og øke evnen til å tjene gebyr fra opptak.
Til slutt, i reklameproduksjonsstudioer, har fremveksten av stemmekloning hjulpet betydelig til å redusere kostnadene og antall timer forbundet med reklameproduksjon. Så lenge det finnes en høykvalitetsopptak tilgjengelig for kloning (selv fra utilgjengelige skuespillere), kan reklamer produseres raskt og mer kreativt enn noensinne før.
Interessant nok kan bedrifter og små og mellomstore bedrifter dra nytte av stemmekloning for å skape noe unikt for sine merker. Store prosjekter kan realisere sine mest ambisiøse planer, mens små bedrifter kan nå tidligere kostbare skalamodeller. Det er hva sant demokratisering betyr.
Oppsummering
AI-stemme-kloning tilbyr bedrifter spillendeende fordeler, som å skape unike kundeopplevelser, integrere naturlig språkbehandling i sine produkter og tjenester, og generere svært nøyaktige etterligninger av stemmer som høres helt ekte ut.
Bedrifter som ønsker å opprettholde sin konkurransefordel i 2023, bør se på AI-stemme-kloning. Selskaper kan bruke denne teknologien til å låse opp en rekke nye muligheter for å vinne markedsshare og beholde kunder, samtidig som de gjør det på en etisk ansvarlig måte.












