Tankeledere

At finde sin autentiske stemme: Hvordan syntetisk stemme kan dele brandhistorier med diverse globale publikummer

mm
Føj Unite.AI til dine foretrukne kilder på Google

Næsten to tredjedele af mennesker, der identificerer sig med en racial eller etnisk minoritet siger, at de er mere sandsynlige at engagere sig med mærker, der inkluderer diverse perspektiver. Men at være divers er mere end at lade kunderne se sig selv i din brand, det handler om at lade dem høre sig selv også.

Sidste år øgede antallet af mærker, der lancerede audio-identiteter for første gang, med 22%. Virksomheder prøver bogstaveligt talt at skære igennem støjen i deres branche og tilpasse deres beskeder bedre til alle de personer, de betjener. Men selvom mærkerne kender de etiske og økonomiske grunde til at fremme diversitet, uanset mediet, ved de ikke altid, hvilke værktøjer der kan hjælpe dem med at gøre det i stor målestok.

Her kommer syntetisk stemme ind i billedet. Teknologien giver mærkerne mulighed for at kommunikere med deres publikum på en mere inklusiv måde – og uden at gå på kompromis med deres autenticitet. Plus, syntetisk stemmes lette brug betyder, at flere mærker kan bruge det og repræsentere flere mennesker. Her er, hvorfor syntetisk stemme vil være højttaleren for mere diverse mærker og deres historier.

Globale virksomheder har brug for globale stemmer

Massiv digital transformation har tvunget mærkerne til at være globale fra dag ét. I en overvejende onlineforretningskreds må virksomhederne betjene kunder i multiple lokaliteter og tale multiple sprog med forskellige accenter, dialekter og ordforråd. Uanset hvilken vertikal du er i, er din brugerbase sandsynligvis blevet diversificeret i de seneste år, og du må efterligne denne udvidelse i din soniske branding.

Europa- og Asien-baserede startups er måske mere parate til at diversificere end deres amerikanske modparter. Virksomheder i USA tenderer til at fokusere primært på det hjemlige marked på grund af størrelsen og omfanget af muligheder der, og diversificerer på et senere tidspunkt, når de går ud over landet. Europæiske og asiatiske startups diversificerer tidligere på grund af det store antal grænser og kulturer, de krydser. At operere på et mindre marked kommer med fordelene af et mere flerstemmigt marked.

Stemme-teknologien er primært bygget til engelsktalende – dels på grund af dens udviklingsrødder i USA, men mere på grund af dens status som det mest talte sprog i verden. Men mere end en milliard taler engelsk som andetsprog og hører sjældent mærke-stemmer, der reflekterer deres accent som en fremmedtalende.

Med syntetisk stemme kan mærkerne arbejde med stemme-skuespillere, der taler engelsk som andetsprog, let og nøjagtigt fange deres vokale nuancer og udrulle den audio over deres markedsføringskampagner. Ikke kun vil mærkerne repræsentere flere sociale grupper, men de kan også udnytte distinkte, stærke accenter som underholdningspersonligheder Sofía Vergara (colombiansk) og Arnold Schwarzenegger (østrigsk) gør.

Replikér mere diverse accenter

Selvom poolen af stemme-skuespillere er vokset i de seneste år, er demografien af skuespillere stadig en hvid, mandlig majoritet. Det er derfor svært at finde stemmer, der har accenter fra mindre eller mere fjernt beliggende steder i verden, for eksempel øen Malta.

Med avanceret brugerdefineret stemme-kloningsteknologi kan stemme-skuespillere fra disse steder (eller selv almindelige mennesker fra dem) læse en bestemt manuskript i en bestemt tone, og have de meget små nuancer i deres accent optaget. Disse accenter kan derefter replikeres i mærkets audio, hvilket giver virksomhederne mulighed for at lokaliserer deres indhold og bringe mindre kendte måder at tale til deres publikum på.

Naturligt er teknologien stadig under udvikling og kræver timer af audio-optagelser for at være robust og at lyde naturligt. Stemme-modeller fungerer bedst, når de er bygget til bestemte brugsområder som radio, fortælling eller reklame, så mærkerne må tage i betragtning, hvilken kontekst stemmen vil blive anvendt i, og finpudse deres proces derefter. Cyklen er endnu mere nuanceret, når sjældne accenter produceres, da mærkerne måske ikke er i stand til at bekræfte, at intonationen og hastigheden er passende for scenariet.

Der er en grund til, at markedet for syntetisk stemme forventes at være værd $36 milliarder i 2025; det er dens evne til (bogstaveligt) at tale til mennesker, der giver mærkerne en direkte linje til deres kunders daglige liv. Og i 2022, hvor mennesker ønsker, at mærkerne skal se og lyde som dem, giver syntetisk stemme mærkerne mulighed for at konveyere flere stemmer, mere højt, og uden at gå på kompromis med deres originale lyd.

Bring mærke-karakterer til live

Sonisk branding er et kraftfuldt værktøj, især blandt yngre, teknologi-kyndige publikummer (der også er nogle af de mest vokale i at kalde mærkerne ud, der ikke er diverse). Faktisk viser forskning fra Storbritannien, at mere end 1 ud af 5 voksne under 35 er mere sandsynlige at købe et mærkes produkt, jo mere de hører lyden, der er forbundet med det mærke.

Men audio behøver ikke at være rigtige mennesker for at være divers. Syntetisk stemme kan realisere fiktive karakterer, der taler til niche-grupper, inkapsler bestemte personlighedstræk eller er simpelthen en sjov, øjeblikkeligt genkendelig udvidelse af mærket. Se blot på lignende Tony the Tiger, Mrs Butterworth og Laughing Cow.

Syntetisk stemme kan være designet ud fra en række kriterier, der konstruerer en ønsket karakter. For eksempel, hvis en karakter er lavet af chokolade og skal lyde sødt, men også lidt åndeløs, som om den smelter. Omfanget af teknologien giver mærkerne en masse kreativ fleksibilitet og er gavnlig til at opbygge en stærkere tilstedeværelse på sociale medie-platforme som Instagram og TikTok, hvor Gen Z-brugere forventer mere unik, kunstnerisk branding.

Dr. Timo Kunz er medstifter og administrerende direktør for Aflorithmic - verdens første fuldt automatiserbare løsning til end-to-end stemme- og lydproduktion fra tekst.