Ajatusjohtajat

Miten generatiiviset ääniteknologiat voidaan käyttää eettisesti liiketoiminnassa vuonna 2023

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Vuoden 2022 loppu toi mukanaan laajan hyväksynnän älyteknologioille, joista OpenAI ja ChatGPT olivat saaneet valtavan suosion. Näin älyteknologia saavutti massamarkkinoiden suosion osoittamalla sen käytännön hyödyn ja arvon liiketoiminnan onnistumisessa.

Monet älyteknologiat, jotka näyttävät kuin vallankumoukselliset arjen ihmisille vuonna 2023, ovat todellisuudessa olleet suurten yritysten ja median käytössä useita vuosia. Liity minuun, kun tarkastelemme tarkemmin näiden ratkaisujen taustalla olevaa teknologiaa, erityisesti generatiivisia äänijärjestelmiä äänen kloonaamiseen, sen liiketoimintahyötyjä ja eettisiä lähestymistapoja älyteknologian käyttöön.

Miten äänen kloonaus toimii?

Lyhyesti sanottuna, äänen kloonaus mahdollistaa yhden henkilön puhumisen toisen henkilön äänellä.

Se käyttää generatiivista älyteknologiaa luomaan äänitallenteita henkilön äänestä ja käyttää niitä uuden äänisisällön luomiseen samalla äänellä. Se mahdollistaa kuulla, mitä joku olisi sanonut, vaikka he eivät itse sitä sanoneet.

Teknisesti asia ei näytä olevan erityisen monimutkainen. Mutta jos syvennytään asiaan, on olemassa joitakin vähimmäisvaatimuksia aloittamiseen:

  1. Tarvitset vähintään 5 minuuttia korkealaatuista äänitallennetta kloonattavasta äänestä. Nämä tallenteet tulee olla selkeitä ja vapaat taustameloista tai muista häiriöistä, sillä mitkä tahansa virheet voivat vaikuttaa mallin tuloksen tarkkuuteen.
  2. Sen jälkeen syötä nämä tallenteet generatiiviseen älymalliin “ääniavataarin” luomiseksi.
  3. Sitten kouluta malli toistamaan puheen sävyä ja aikaa.
  4. Kun tämä on valmis, koulutettu malli voi luoda rajattoman määrän sisältöä alkuperäisen henkilön äänellä, muodostaen tehokkaan työkalun realististen ääniäänien luomiseen.

Tässä vaiheessa monet herättävät eettisiä huolenaiheita. Mitä tapahtuu, kun voimme lisätä minkä tahansa tekstin toisen henkilön suuhun ja on mahdotonta erottaa, ovatko sanat aitoja vai väärennettyjä?

Kyllä, tämä mahdollisuus on jo pitkään ollut todellisuus. Kuten OpenAI:n ja ChatGPT:n tapauksessa, kohtaamme nyt useita eettisiä ongelmia, joita ei voida jättää huomiotta.

Eettiset standardit älyteknologioissa

Kuten monissa muissa uusissa teknologioissa niiden alkuvaiheessa, pääuhka on luoda teknologian ympärille negatiivinen stigma sen sijaan, että tunnustetaan uhkat ja niistä johtuvat keskustelut ja tieto. Tärkeää on paljastaa pahantahtoisten toimijoiden käyttämät menetelmät hyödyntääkseen teknologiaa ja sen tuotteita, soveltaa lieventäviä keinoja ja jatkaa oppimista.

Tänään meillä on kolme kerrosta eettisiä standardeja, jotka liittyvät generatiivisen älyteknologian käyttöön. Kansalliset ja ylilaidalliset sääntelykerrokset ovat kehityksensä alkuvaiheessa. Vaikka politiikka ei välttämättä pysy käynnissä olevan teknologian kehityksen tahdissa, voimme jo havaita, miten EU johtaa EU:n ehdotus älyteknologian sääntelystä ja Vuoden 2022 parannettu toimintakoodi tietojen väärentämisen estämiseksi, joka määrittää suurten teknologiayritysten odotukset väärennetyn älyteknologian sisällön leviämisen torjumiseksi. Kansallisella tasolla näemme Yhdysvaltojen ja Iso-Britannian ensimmäisiä askelia ongelman ratkaisemiseksi Yhdysvaltojen Kansallisen deepfake- ja digitaalisen alkuperän työryhmän ja Iso-Britannian Verkkoviranomaisuuslakia.

Teknologiayritysten kerros etenee nopeammin, sillä yritykset ja teknologit hyväksyvät tämän uuden todellisuuden älyteknologian vaikutuksineen yhteiskunnan turvallisuuteen ja yksityisyyteen. Generatiivisen älyteknologian eettisyyden keskustelu on vilkasta ja on johtanut älyteknologian käytön eettisten ohjeiden kehittämiseen (esim. Älyteknologian kumppanuuden synteettisen median eettinen ohje) ja eri yritysten julkaisemista eettisistä lausumista. Kysymys on, miten tehdä käytännössä? Ja voivatko ne vaikuttaa tuotteisiin, erityisiin ominaisuuksiin ja tiimien prosesseihin?

Työskennellessäni tämän ongelman parissa useiden eri median, viihteen, kyberturva- ja älyteknologian eettisyyden yhteisöjen kanssa, olen muodostanut joitakin käytännön periaatteita älyteknologisen sisällön ja äänien käsittelemiseksi erityisesti:

  1. Tekijänoikeuden omistajat ja yritys, joka käyttää kloonattua ääntä, voivat välttää monia mahdollisia ongelmia alkuperäisten äänten käytöstä allekirjoittamalla laillisia sopimuksia.
  2. Projektin omistajien tulisi julkisesti ilmoittaa kloonatun äänen käytöstä, jotta kuulijat eivät joudu harhaan.
  3. Yritykset, jotka työskentelevät älyteknologian parissa äänen kloonaamiseen, tulisi varata osa resursseistaan kehittämään teknologiaa, joka pystyy havaitsemaan ja tunnistamaan älyteknologian luoman sisällön.
  4. Älyteknologian luoman sisällön merkitseminen vesileimalla mahdollistaa äänen todennuksen.
  5. Jokaisen älyteknologian palveluntarjoajan tulisi arvioida kunkin projektin vaikutuksia (yhteiskunnallinen, liiketoimintatason ja yksityisyyden suojelu) ennen kuin suostuu työskentelemään siinä.

Tietysti älyteknologian eettiset periaatteet eivät vaikuta itse tehtyjen deep fake -videoitten leviämiseen verkossa. Ne kuitenkin ajavat harmaan alueen projekteja pois julkisesta markkinasta.

Vuonna 2021-22 älyäänet käytettiin useissa suurissa projekteissa, joissa oli merkittäviä eettisiä ja yhteiskunnallisia vaikutuksia. Niihin kuului nuoren Luke Skywalkerin äänen kloonaus Mandalorian -sarjaan, älyääni God of War 2:een ja Richard Nixonin ääni historialliseen “Kuin kuun onnettomuuden sattuessa” -puheeseen.

Luottamus teknologiaan kasvaa median ja viihteen ulkopuolella. Perinteiset yritykset useilla aloilla käyttävät kloonattuja ääniä projekteissaan. Tässä on muutamia merkittävimmistä käyttötarkoituksista.

Teollisuuden sovellukset

Vuonna 2023 äänen kloonaus jatkaa kasvuaan useiden yritysten hyödyntäessä sen monia hyötyjä. Terveydenhuollosta markkinointiin, asiakaspalveluun ja mainontaan, äänen kloonaus vallitsee, miten organisaatiot rakentavat suhteita asiakkaidensa kanssa ja tehostavat työprosessejaan.

Äänen kloonaus hyödyttää terveydenhuollon ammattilaisia ja sosiaalitoimijoita, jotka työskentelevät verkossa. Digitaaliset avataarit, joissa on sama ääni kuin lääkäreillä, lujittavat siteitä potilaiden kanssa, kasvattavat luottamusta ja pitävät asiakkaat kiinni.

Äänen kloonaamisen soveltamismahdollisuudet elokuva- ja viihdealaan ovat laajat. Sisällön dubbaus useille kielille, lasten ja aikuisten lisädialogin korvaaminen (ADR) ja lähes rajattomat mukauttamisvaihtoehdot ovat kaikki mahdollisia tämän teknologian ansiosta.

Vastaavasti operatiivisissa toimissa älyteknologian äänen kloonaus voi tuottaa erinomaisia tuloksia brändeille, jotka tarvitsevat kustannustehokkaita ratkaisuja interaktiivisille äänivastausjärjestelmille tai yritysvideoille. Äänisynteesiteknologian avulla näyttelijät voivat laajentaa ulottuvuuttaan ja lisätä ansioitaan äänitallenteista.

Lopulta mainosstudiossa äänen kloonaamisen kehittyminen on auttanut merkittävästi vähentämään mainosten tuotantokustannuksia ja -tunteja. Kun on saatavilla laadukas äänitallenne kloonaamiseen (jopa saatavilla olevilta näyttelijöiltä), mainoksia voidaan tuottaa nopeasti ja luovasti kuin koskaan aiemmin.

Mielenkiintoista kyllä, suuret yritykset ja pk-yritykset voivat hyödyntää äänen kloonausta luodakseen jotain ainutlaatuista brändeilleen. Suuret projektit voivat toteuttaa urheilullisimmat suunnitelmansa, kun taas pienet yritykset voivat päästä käsiksi aiemmin kalliisiin mittakaavoittamismalleihin. Tämä on todellista demokratisointia.

Yhteenveto

Älyteknologian äänen kloonaus tarjoaa liiketoiminnalle pelimuuttavan edun, kuten ainutlaatuiset asiakaskokemukset, luonnollisen kielen prosessoinnin integroimisen tuotteisiin ja palveluihin sekä erittäin tarkkojen ääniäänien luominen, jotka kuulostavat täysin aidoilta.

Yritykset, jotka haluavat ylläpitää kilpailukykyään vuonna 2023, tulisi tutustua älyteknologian äänen kloonaamiseen. Yritykset voivat käyttää tätä teknologiaa lukuisiin uusiin mahdollisuuksiin markkinaosuuksien voittamiseksi ja asiakkaiden pitämiseksi, samalla toimien eettisesti vastuullisella tavalla.

Anna on Respeecher-yrityksen eettisten ja kumppanuussuhteiden johtaja, joka on Emmy-palkittu äänenkloonaukseen erikoistunut teknologia, joka sijaitsee Ukrainassa. Anna on entinen Refacen politiikkaneuvonantaja, joka on tekoälykäyttöinen syntetisen median sovellus, ja hän on myös vastuussa disinformaation vastaisen työkalun Cappturen perustamisesta, jonka rahoittaa Startup Wise Guys -kiihdytysohjelma. Anna on 11 vuoden kokemus turvallisuus- ja puolustuspolitiikasta, -teknologioista ja -kestävyyden kehittämisestä. Hän on entinen tutkija Kansainvälisessä puolustus- ja turvallisuuskeskuksessa Tallinnassa ja Prahan turvallisuustutkimusinstituutissa. Hän on myös neuvonut suuria ukrainalaisia yrityksiä kestävyyden kehittämisestä osana Kyivin talouskoulun hybridisotatoimintaryhmää.