Tankeledere
Å finne din autentiske stemme: Hvordan syntetisk stemme kan dele merkehistorier med diverse globale publikum

Nesten to tredeler av personer som identifiserer seg med en rase- eller etnisk minoritet sier at de er mer sannsynlig å engasjere med merker som inkluderer diverse perspektiver. Men å være divers er mer enn å la kundene se seg selv i ditt merke, det handler om å la dem høre seg selv også.
I fjor økte antallet merker som lanserte audio-identiteter for første gang med 22%. Selskaper prøver bokstavelig talt å kutte gjennom støyen i deres bransje og tilpasse sin melding til alle individene de betjener. Men mens merker vet de etiske og økonomiske grunnene til å fremme diversitet uansett medium, vet de ikke alltid verktøyene som kan hjelpe dem å gjøre det i stor skala.
Syntetisk stemme kommer inn i bildet. Teknologien gjør det mulig for merker å kommunisere med publikum på en mer inkluderende måte – og uten å kompromittere sin autentisitet. Pluss, lettbrukeligheten av syntetisk stemme gjør at flere merker kan bruke den og representere flere mennesker. Her er hvorfor syntetisk stemme vil være høyttaleren for mer diverse merker og deres historier.
Globale selskaper trenger globale stemmer
Massiv digital transformasjon har ført til at merker må være globale fra dag én. I en overveiende online forretningskrets må selskaper betjene kunder i flere lokasjoner og som snakker flere språk med forskjellige aksenter, dialekter og vokabular. Uansett hvilken vertikal du er i, har din brukerbase sannsynligvis diversifisert seg i de siste årene, og du må gjenspeile denne utvidelsen i din soniske merkevare.
Europa- og Asia-baserte startup-selskaper er kanskje mer forberedt på å diversifisere enn deres amerikanske motparter. Selskaper i USA tenderer til å fokusere hovedsakelig på det hjemlige markedet på grunn av størrelsen og omfanget av muligheter der, og diversifiserer på et senere tidspunkt når de går utenfor landet. Europeiske og asiatiske startup-selskaper diversifiserer tidligere på grunn av rekkevidden og kulturene de krysser. Å operere i et mindre marked kommer faktisk med fordelen av et mer multi-voicet marked.
Stemme-teknologi er primært bygget for engelsktalende – delvis på grunn av utviklingsrøttene i USA, men mer på grunn av dens status som det mest talte språket i verden. Men mer enn en milliard snakker engelsk som et annet språk og hører sjelden merke-stemmer som reflekterer deres aksent som en utenlandsk taler.
Med syntetisk stemme kan merker arbeide med stemmeskuespillere som snakker engelsk som et annet språk, lett og nøyaktig fange deres vokale nyanser og distribuere den audio over deres markedsføringskampanjer. Ikke bare vil merker representere flere sosiale grupper, de kan også kapitalisere på distinkte, sterke aksenter som underholdningspersonligheter Sofía Vergara (kolombiansk) og Arnold Schwarzenegger (østerriksk) gjør.
Repliserer mer diverse aksenter
Mens reservoiret av stemmeskuespillere har vokst i de siste årene, er demografien til skuespillerne fortsatt en hvit, mannsdominert majoritet. Det er derfor vanskelig å finne stemmer som har aksenter fra mindre eller mer avsidesliggende steder i verden, for eksempel øya Malta.
Med sofistikert tilpasset stemme-kloningsteknologi kan stemmeskuespillere fra disse stedene (eller selv vanlige mennesker fra dem) lese en bestemt manus i en bestemt tone, og få de svært små nyansene i deres aksent registrert. Disse aksentene kan deretter repliseres i merkeaudio, og la selskaper lokalisere innholdet og bringe mindre kjente måter å snakke til deres publikum.
Selvfølgelig er teknologien fortsatt under utvikling og trenger timer med audio-innspillinger for å være robust og å høres naturlig ut. Stemmemodeller fungerer best når de er bygget for bestemte bruksområder som radio, fortelling eller reklame, så selskaper må ta hensyn til hva konteksten stemmen vil bli brukt i, og finjustere prosessen deretter. Syklusen er enda mer nyansert når sjeldne aksenter produseres, da selskaper kanskje ikke kan bekrefte at intonasjonen og hastigheten er passende for scenarioet.
Det er en grunn til at markedet for syntetisk stemme forventes å være verdt $36 milliarder i 2025; det er evnen til å (bokstavelig talt) snakke til mennesker som gir merker en direkte linje til kundenes daglige liv. Og i 2022, når mennesker ønsker at merker skal se og høres ut som dem, lar syntetisk stemme selskaper formidle flere stemmer, mer høyt, og uten å tape sin originale lyd.
Få merke-karakterer til live
Sonic branding er et kraftig verktøy, spesielt blant yngre, teknisk kyndige publikum (som også er noen av de mest vokale i å kalle ut merker som ikke er diverse). Faktisk viser forskning fra Storbritannia at mer enn 1 av 5 voksne under 35 er mer sannsynlig å kjøpe et merkes produkt, jo mer de hører lyden som er assosiert med det merket.
Men audio ikke behøver å være ekte mennesker for å være ansett som divers. Syntetisk stemme kan realisere fiktive karakterer som snakker til nisjegrupper, inkapsler bestemte personlighetstrekk eller er bare en morsom, øyeblikkelig gjenkjennelig utvidelse av merket. Se bare på likene av Tony the Tiger, Mrs Butterworth og Laughing Cow.
Syntetisk stemme kan være designet basert på en sett av kredensialer som konstruerer en ønsket karakter. For eksempel, hvis en karakter er laget av sjokolade og skal høres søt ut, men også litt åndeløs som om den smelter. Omfanget av teknologien gir merker en stor kreativ fleksibilitet, og er gunstig for å bygge en sterkere tilstedeværelse på sosiale medieplattformer som Instagram og TikTok, hvor Gen Z-brukere forventer mer unike, kunstneriske merkevare.












