Thought leaders

Het vinden van uw authentieke stem: Hoe synthetische stemmen de verhalen van merken kunnen delen met diverse wereldwijde publieken

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Bijna twee derde van de mensen die zich identificeren met een raciale of etnische minderheid zeggen dat ze meer geneigd zijn om zich te engageren met merken die diverse perspectieven omvatten. Maar divers zijn is meer dan alleen klanten in staat stellen om zichzelf in uw merk te zien, het gaat erom dat ze zichzelf ook kunnen horen.

Vorig jaar nam het aantal merken dat voor het eerst audio-identiteiten lanceerde met 22% toe. Bedrijven proberen letterlijk door de ruis in hun branche heen te komen en hun boodschap beter af te stemmen op alle individuen die ze bedienen. Maar terwijl merken de ethische en economische redenen kennen om diversiteit te bevorderen, ongeacht het medium, weten ze niet altijd welke tools ze kunnen gebruiken om dit op grote schaal te doen.

Daarom is synthetische stem een oplossing. Deze technologie stelt merken in staat om op een meer inclusieve manier met hun publiek te communiceren, zonder hun authenticiteit te compromitteren. Bovendien maakt de eenvoud van synthetische stem het mogelijk voor meer merken om het te gebruiken en meer mensen te vertegenwoordigen. Hieronder leggen we uit waarom synthetische stem het luidspreker zal zijn voor meer diverse merken en hun verhalen.

Globale bedrijven hebben globale stemmen nodig

De massale digitale transformatie heeft ertoe geleid dat bedrijven vanaf het begin wereldwijd actief zijn. In een overwegend online zakenwereld moeten bedrijven klanten in meerdere locaties en met meerdere talen, accenten, dialecten en vocabulaire bedienen. Ongeacht de branche waarin u actief bent, is uw gebruikersbasis waarschijnlijk in de afgelopen jaren gevarieerder geworden, en u moet die uitbreiding weerspiegelen in uw sonische branding.

Startups in Europa en Azië zijn misschien beter toegerust om te diversifiëren dan hun Amerikaanse tegenhangers. Bedrijven in de Verenigde Staten richten zich voornamelijk op de binnenlandse markt vanwege de omvang en het bereik van de kansen daar, en diversifiëren pas later wanneer ze de landsgrenzen overschrijden. Europese en Aziatische startups diversifiëren eerder omdat ze een reeks grenzen en culturen overschrijden. Opereren in een kleinere markt heeft het voordeel van een meer gemengde markt.

Stemtechnologie is voornamelijk ontwikkeld voor Engelssprekenden – deels vanwege de ontwikkelingswortels in de Verenigde Staten, maar meer vanwege de status als meest gesproken taal ter wereld. Toch spreken meer dan een miljard mensen Engels als tweede taal en horen ze zelden merkstemmen die hun accent als buitenlandse spreker weerspiegelen.

Met synthetische stem kunnen bedrijven samenwerken met stemacteurs die Engels als tweede taal spreken, hun vocale nuances gemakkelijk en nauwkeurig vastleggen en die audio gebruiken in hun marketingcampagnes. Niet alleen zullen bedrijven meer sociale groepen vertegenwoordigen, maar kunnen ze ook profiteren van distinctieve, sterke accenten zoals entertainmentpersoonlijkheden Sofía Vergara (Colombiaans) en Arnold Schwarzenegger (Oostenrijks) doen.

Repliceer meer diverse accenten

Terwijl het aantal stemacteurs in de afgelopen jaren is toegenomen, is de demografie van acteurs nog steeds een overwegend witte, mannelijke meerderheid. Het is daarom moeilijk om stemmen te vinden met accenten uit kleinere of meer afgelegen locaties in de wereld, zoals het eiland Malta.

Met geavanceerde aangepaste stemkloon-technologie kunnen stemacteurs uit deze gebieden (of zelfs gewone mensen uit deze gebieden) een specifiek script in een bepaalde toon lezen en hebben de zeer subtiele nuances in hun accent opgenomen. Deze accenten kunnen vervolgens in de audio van het merk worden gerepliceerd, waardoor bedrijven hun inhoud kunnen lokaliseren en minder bekende manieren van praten aan hun publiek kunnen presenteren.

Natuurlijk is de technologie nog in ontwikkeling en zijn uren aan audio-opnames nodig om robuust en natuurlijk klinkend te zijn. Stemmodellen functioneren het beste wanneer ze zijn gebouwd voor specifieke use-cases zoals radio, narratie of reclame, dus bedrijven moeten rekening houden met de context waarin de stem zal worden toegepast en hun proces dienovereenkomstig verfijnen. De cyclus is nog meer genuanceerd wanneer zeldzame accenten worden geproduceerd, aangezien bedrijven mogelijk niet gemakkelijk kunnen bevestigen dat de intonatie en snelheid geschikt zijn voor het scenario.

Er is een reden waarom de synthetische stemmarkt naar verwachting 36 miljard dollar waard zal zijn in 2025; het vermogen om (letterlijk) met mensen te praten geeft bedrijven een directe lijn naar het dagelijks leven van hun klanten. En in 2022, wanneer mensen willen dat bedrijven eruitzien en klinken als zij, laat synthetische stem bedrijven toe om meer stemmen te vertegenwoordigen, luider en zonder hun oorspronkelijke geluid te verliezen.

Breng merkpersonages tot leven

Sonic branding is een krachtig instrument, vooral onder jongere, technisch onderlegde publieken (die ook een van de meest vocale zijn in het aanklagen van bedrijven die niet divers zijn). In feite toont onderzoek uit het VK aan dat meer dan 1 op de 5 volwassenen onder de 35 meer geneigd zijn om een product van een merk te kopen, naarmate ze het geluid dat met dat merk is geassocieerd vaker horen.

Maar audio hoeft niet per se echte mensen te zijn om als divers te worden beschouwd. Synthetische stem kan fictieve personages realiseren die tot niche-groepen spreken, bepaalde persoonlijkheidskenmerken omvatten of gewoon een leuke, herkenbare uitbreiding van het merk zijn. Kijk naar de likes van Tony de Tijger, Mevrouw Butterworth en de Lachende Koe.

Synthetische stem kan worden ontworpen op basis van een set referenties die een gewenst personage construeren. Bijvoorbeeld, als een personage is gemaakt van chocolade en moet zoet klinken, maar ook een beetje buiten adem, alsof het smelt. De reikwijdte van de technologie geeft bedrijven veel creatieve flexibiliteit en is gunstig om een sterkere aanwezigheid op sociale mediaplatforms zoals Instagram en TikTok op te bouwen, waar Gen Z-gebruikers meer unieke, artistieke branding verwachten.

Dr. Timo Kunz is de mede-oprichter en CEO van Aflorithmic - de werelds eerste volledig automatische oplossing voor eind-tot-eind spraak- en audiocreatie vanuit tekst.