Tankeledare
Hitta din autentiska röst: Hur syntetisk röst kan dela varumärkesberättelser med mångfaldiga globala publik

Nästan två tredjedelar av de människor som identifierar sig med en ras- eller etnisk minoritet säger att de är mer benägna att engagera sig med varumärken som inkluderar mångfaldiga perspektiv. Men att vara mångfaldig är mer än att låta kunder se sig själva i ditt varumärke, det handlar om att låta dem höra sig själva också.
Förra året ökade antalet varumärken som lanserade ljudidentiteter för första gången med 22%. Företagen försöker bokstavligen att tränga igenom bruset i sin bransch och anpassa sin kommunikation till alla individer de betjänar. Men medan varumärkena känner till de etiska och ekonomiska skälen att främja mångfald oavsett medium, vet de inte alltid vilka verktyg som kan hjälpa dem att göra det i stor skala.
Här kommer syntetisk röst in i bilden. Teknologin möjliggör för varumärken att kommunicera med sin publik på ett mer inkluderande sätt – och utan att kompromissa med sin autenticitet. Plus, det är lätt att använda syntetisk röst, vilket innebär att fler varumärken kan använda den och representera fler människor. Här är varför syntetisk röst kommer att vara högtalaren för fler mångfaldiga varumärken och deras berättelser.
Globala företag behöver globala röster
Den massiva digitala transformationen har drivit varumärken att vara globala från dag ett. I en övervägande onlineaffärssfär måste företagen betjäna kunder i flera länder och som talar flera språk med olika accenter, dialekter och ordförråd. Oavsett vilken bransch du är i, har din användarbas troligen diversifierats under de senaste åren, och du måste återspegla den expansionen i din ljudmärkesidentitet.
Europa- och Asienbaserade startups är kanske mer redo att diversifiera sig än sina amerikanska motparter. Företag i USA tenderar att fokusera främst på den inhemska marknaden på grund av storleken och omfattningen av möjligheterna där, och diversifierar sig senare när de går utöver landet. Europeiska och asiatiska startups diversifierar sig tidigare på grund av de gränser och kulturer de korsar. Att verka på en mindre marknad kommer faktiskt med fördelen av en mer mångfacetterad marknad.
Röstteknologin är främst byggd för engelsktalande – delvis på grund av dess utvecklingsrötter i USA, men mer på grund av dess status som det mest talade språket i världen. Men mer än en miljard talar engelska som ett andra språk och höra sällan varumärkesröster som återger deras accent som en utländsk talare.
Med syntetisk röst kan varumärken arbeta med röstskådespelare som talar engelska som ett andra språk, lätt och exakt fånga deras vokala nyanser och distribuera den ljudet över hela sin marknadsföringskampanj. Inte bara kommer varumärken att representera fler sociala grupper, utan de kan också kapitalisera på distinkta, starka accenter som underhållningspersonligheter som Sofía Vergara (kolumbianska) och Arnold Schwarzenegger (österrikiska) gör.
Replikera fler mångfaldiga accenter
Medan poolen av röstskådespelare har vuxit under de senaste åren, är demografin för skådespelare fortfarande en vit, manlig majoritet. Det är därför svårt att hitta röster som har accenter från mindre eller mer avlägsna platser i världen, till exempel ön Malta.
Med avancerad anpassad röstkloningsteknologi kan röstskådespelare från dessa platser (eller till och med vanliga människor från dem) läsa en specifik manus i en viss tonhöjd och få de mycket subtila nyanserna i deras accent inspelade. Dessa accenter kan sedan replikeras i varumärkets ljud, vilket gör det möjligt för företagen att lokalisera sitt innehåll och bringa mindre kända sätt att tala till sin publik.
Naturligtvis är teknologin fortfarande under utveckling och behöver timmar av ljudinspelningar för att vara robust och låta naturligt. Röstmodeller fungerar bäst när de är byggda för specifika användningsfall som radio, berättande eller reklam, så varumärkena måste ta hänsyn till i vilket sammanhang rösten kommer att användas och finslipa sin process därefter. Cykeln är ännu mer nyanserad när sällsynta accenter produceras, eftersom varumärkena kanske inte är redo att bekräfta att intonationen och hastigheten är lämpliga för scenariot.
Det finns en anledning till att den syntetiska röstmarknaden förväntas vara värd 36 miljarder dollar år 2025; dess förmåga att (bokstavligen) tala till människor ger varumärkena en direkt linje till kundernas dagliga liv. Och 2022, när människor vill att varumärkena ska se och låta ut som dem, låter syntetisk röst varumärkena konveyera fler röster, högre, och utan att förlora sin ursprungliga ljud.
Förverkliga varumärkeskaraktärer
Ljudmärkesidentitet är ett kraftfullt verktyg, särskilt bland yngre, tekniskt kunniga publik (som också är några av de mest uttalade i att kalla ut varumärken som inte är mångfaldiga). Faktum är att forskning från Storbritannien visar att mer än en av fem vuxna under 35 är mer benägna att köpa en varumärkesprodukt, ju mer de hör ljudet som är associerat med varumärket.
Men ljud behöver inte vara riktiga människor för att anses vara mångfaldigt. Syntetisk röst kan förverkliga fiktiva karaktärer som talar till nischgrupper, inkapslar vissa personlighetsdrag eller är helt enkelt en rolig, omedelbart igenkännlig utvidgning av varumärket. Se bara på exempel som Tony the Tiger, Mrs Butterworth och Laughing Cow.
Syntetisk röst kan utformas baserat på en uppsättning kvalifikationer som konstruerar en önskad karaktär. Till exempel, om en karaktär är gjord av choklad och ska låta söt men också lite andfådd som om den smälter. Omfattningen av teknologin ger varumärkena en stor kreativ flexibilitet och är fördelaktig för att bygga en starkare närvaro på sociala medieplattformar som Instagram och TikTok, där Gen Z-användare förväntar sig mer unika, konstnärliga varumärken.












