Myslitelé

Jak používat generativní AI hlasy eticky pro podnikání v roce 2023

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Konec roku 2022 přišel na хвилі širokého přijetí AI technologií díky ohromující popularitě OpenAI a ChatGPT. Poprvé AI dosáhlo masového trhu tím, že prokázalo svou užitečnost a hodnotu při vytváření úspěšných obchodních výsledků.

Mnohé AI technologie, které se zdají být revolucí pro běžné lidi v roce 2023, byly ve skutečnosti používány velkými podniky a médii již několik let. Připojte se ke mně, když se blíže podívám na technologii, která pohání tyto řešení, zejména generativní AI systémy pro klonování hlasu, jeho obchodní výhody a etické přístupy k používání AI.

Jak funguje klonování hlasu?

Stručně řečeno, klonování hlasu umožňuje jedné osobě mluvit pomocí hlasu jiné osoby.

Používá technologii generativního AI k vytvoření nahrávek hlasu osoby a jejich použití k vytvoření nových audioobsahů s týmž hlasem. Základní umožňuje lidem slyšet, co by někdo řekl, i když to sami neřekli.

Z technického hlediska se věci nezdají být příliš složité. Ale pokud se trochu hlouběji podíváte, existují určitá minimální požadavky pro začátek:

  1. Potřebujete alespoň 5 minut kvalitních nahrávek zdrojového hlasu, aby jste jej mohli zkopírovat. Tyto nahrávky by měly být čisté a bez pozadí nebo jiných zkreslení, protože jakékoli nedokonalosti by mohly ovlivnit přesnost výstupu modelu.
  2. Poté tyto nahrávky vložte do modelu generativního AI, aby vytvořily “hlasový avatar”.
  3. Poté tuto avataru trénujte, aby přesně reprodukovala vzorce řeči v tónu a časování.
  4. Jakmile je dokončeno, tento trénovaný model může generovat neomezený obsah pomocí zdrojového hlasu jiné osoby, stává se tak účinným nástrojem pro vytváření realisticky znějících replik hlasů.

Toto je bod, ve kterém mnozí zvedají etické obavy. Co se stane, když budeme moci vložit jakýkoli text do úst jiné osoby a nebude možné určit, zda jsou tato slova skutečná nebo falešná?

Ano, tato možnost se již stala realitou. Stejně jako v případě OpenAI a ChatGPT, nyní čelíme řadě etických problémů, které nelze ignorovat.

Etické standardy v AI

Jako u mnoha dalších nových technologií ve fázi počáteční adopce, hlavním hrozbou je vytváření negativní stigmatizace kolem technologie, místo toho, aby se uznaly hrozby jako zdroj diskuse a cenných znalostí. Co je důležité, je odhalit metody, které zneužívají technologii a její produkty, aplikovat nástroje pro zmírnění a pokračovat v učení.

Dnes máme tři vrstvy rámců pro etické standardy týkající se používání generativního AI. Národní a nadnárodní regulační vrstvy jsou ve fázi počáteční tvorby. Svět politik nemusí držet krok s rychlostí vývoje nových technologií, ale již můžeme pozorovat, jak EU vede s návrhem EU na regulaci AI a Kódem chování pro rok 2022 o dezinformacích, který stanoví očekávání pro velké technologické společnosti, aby se vypořádaly se šířením škodlivého obsahu manipulovaného AI. Na národní úrovni vidíme regulační první kroky ze strany USA a Spojeného království při řešení problému s Národním úkolem pro hluboké podvody a digitální prokazatelnost a Zákonem o online bezpečnosti.

Průmyslová vrstva se pohybuje rychleji, protože společnosti a technologové přijímají tuto novou realitu týkající se nových technologií a jejich dopadu na bezpečnost a soukromí společnosti. Dialog o etice generativního AI je živý a vedl k vývoji iniciativ pro kodexy chování pro používání generativního AI (například Kodex chování pro syntetická média Partnership on AI) a etické prohlášení vydané různými společnostmi. Otázka je, jak učinit chování praktickým? A zda jsou schopni ovlivnit produkty, konkrétní funkce a postupy týmů?

Pracoval jsem na tomto problému s mnoha různými médii a zábavou, kybernetickou bezpečností a komunitami AI etiky, a vytvořil jsem několik praktických zásad pro nakládání s AI obsahem a hlasy, zejména:

  1. Vlastníci duševního vlastnictví a společnost, která používá zkopírovaný hlas, mohou se vyhnout mnoha potenciálním komplikacím spojeným s používáním původních hlasů podepsáním právních dohod.
  2. Vlastníci projektů by měli veřejně prohlásit, že používají zkopírovaný hlas, aby nebyli posluchači zmátenci.
  3. Společnosti, které pracují na AI technologii pro hlas, by měly přidělit procento zdrojů na vývoj technologií, které jsou schopny detekovat a identifikovat AI generovaný obsah.
  4. Označení AI vygenerovaného obsahu vodotiskem umožňuje ověření hlasu.
  5. Každý poskytovatel AI služeb by měl přezkoumat každý projekt z hlediska jeho dopadu (společenské, obchodní a soukromé úrovně) předtím, než se dohodne na jeho realizaci.

Samozřejmě, že zásady etiky v AI neovlivní šíření domácích hlubokých padělků online. Nicméně, budou tlačit všechny projekty v šedé zóně mimo dosah veřejného trhu.

V letech 2021-22 byly AI hlasy použity v různých hlavních projektech, které měly značné dopady na etiku a společnost. Patří mezi ně zkopírování hlasu mladého Lukea Skywalkera pro seriál Mandalorian, AI hlas pro Boha války 2 a hlas Richarda Nixona pro historickou řeč “V případě měsíční katastrofy”.

Důvěra v technologii roste za hranicemi médií a zábavy. Tradiční podniky napříč mnoha odvětvími používají zkopírované hlasy ve svých projektech. Zde jsou beberapa z nejvýznamnějších případů použití.

Případy použití v průmyslu

V roce 2023 bude klonování hlasu pokračovat ve svém růstu spolu s různými podniky, které budou využívat jeho mnoha výhod. Od zdravotnictví a marketingu po zákaznický servis a reklamní průmysl, klonování hlasu revolucionalizuje, jak organizace budují vztahy se svými klienty a optimalizují své pracovní postupy.

Klonování hlasu přináší výhody zdravotnickým odborníkům a sociálním pracovníkům, kteří pracují v online prostředí. Digitální avatary se stejným hlasem jako zdravotničtí odborníci vytvářejí silnější vazby mezi nimi a jejich pacienty, zvyšují důvěru a udržují zákazníky.

Potenciální aplikace klonování hlasu ve filmovém a zábavním průmyslu jsou rozsáhlé. Dubbing obsahu do více jazyků, děti a dospělí další dialogové náhrady (ADR) a téměř nekonečné možnosti přizpůsobení jsou všechny umožněny touto technologií.

Podobně, v operačním sektoru, AI poháněné klonování hlasu může přinést vynikající výsledky pro značky, které potřebují nákladově efektivní řešení pro interaktivní hlasové systémy nebo firemní tréninková videa. S technologií syntézy hlasu mohou herci rozšířit své dosah a zvýšit své schopnosti vydělávat z nahrávek.

Nakonec, v reklamních produkčních studiích, vznik klonování hlasu výrazně snížil náklady a počet hodin spojených s komerční produkcí. Pokud je k dispozici kvalitní nahrávka pro klonování (i z nedostupných herců), reklamy lze produkovat rychleji a kreativněji než kdykoli předtím.

Zajímavé je, že podniky a malé a střední podniky mohou využít klonování hlasu, aby vytvořily něco jedinečného pro své značky. Velké projekty mohou realizovat své nejambicióznější plány, zatímco malé podniky mohou získat přístup k dříve nákladově neúnosným modelům. To je pravá demokratizace.

Závěrem

Klonování hlasu AI nabízí podnikům hru měnící výhody, jako je vytváření jedinečných zákaznických zkušeností, integrace přirozeného jazykového zpracování do svých produktů a služeb a generování vysoce přesných napodobenin hlasů, které znějí zcela reálně.

Podniky, které chtějí udržet svou konkurenční výhodu v roce 2023, by se měly podívat na klonování hlasu AI. Společnosti mohou tuto technologii použít, aby odemkly řadu nových možností pro získání podílu na trhu a udržení zákazníků, a to způsobem, který je eticky odpovědný.

Anna je vedoucí etiky a partnerství ve společnosti Respeecher, která je držitelem Emmy a specializuje se na technologii klonování hlasu se sídlem na Ukrajině. Anna je bývalá poradkyně pro politiku ve společnosti Reface, která je aplikací pro syntetická média poháněná umělou inteligencí, a je také technickou spoluzakladatelkou nástroje pro boj proti dezinformacím Cappture, který je financován akceleračním programem Startup Wise Guys. Anna má 11 let zkušeností v oblasti bezpečnostních a obranných politik, technologií a budování odolnosti. Byla také výzkumnou pracovnicí v Mezinárodním centru pro obranu a bezpečnost v Tallinnu a v Pražském institutu bezpečnostních studií. Rovněž poskytla poradenské služby významným ukrajinským společnostem v oblasti budování odolnosti jako součást Hybridní úkolu bojové skupiny na Kyjevské ekonomické škole.