Leaders d’opinion

Trouver votre voix authentique : Comment la voix synthétique peut partager les histoires de marque avec des publics mondiaux diversifiés

mm
Ajouter Unite.AI à vos sources préférées sur Google

Près des deux tiers des personnes qui s’identifient à une minorité raciale ou ethnique disent qu’ils sont plus susceptibles de s’engager avec des marques qui incluent des perspectives diverses. Mais être diversifié, c’est plus que de permettre aux clients de se voir dans votre marque, c’est aussi de les laisser les entendre.

L’année dernière, le nombre de marques qui ont lancé des identités audio pour la première fois a augmenté de 22%. Les entreprises essaient littéralement de se démarquer dans leur industrie et de personnaliser leur messagerie pour tous les individus qu’elles servent. Mais même si les marques connaissent les raisons éthiques et économiques pour promouvoir la diversité, quelle que soit la plateforme, elles ne connaissent pas toujours les outils pour le faire à grande échelle.

C’est là que la voix synthétique entre en jeu. La technologie permet aux marques de communiquer avec leur public de manière plus inclusive – et sans compromettre leur authenticité. De plus, la facilité d’utilisation de la voix synthétique signifie que plus de marques peuvent l’utiliser et représenter plus de personnes. Voici pourquoi la voix synthétique sera le porte-voix de marques plus diversifiées et de leurs histoires.

Les entreprises mondiales ont besoin de voix mondiales

La transformation numérique de masse a poussé les marques à être mondiales dès le premier jour. Dans une sphère commerciale principalement en ligne, les entreprises doivent servir des clients dans plusieurs emplacements et parlant plusieurs langues avec différents accents, dialectes et vocabulaires. Quel que soit le secteur dans lequel vous vous trouvez, votre base d’utilisateurs a probablement diversifié ces dernières années, et vous devez refléter cette expansion dans votre marque sonore.

Les startups basées en Europe et en Asie sont peut-être plus prêtes à diversifier que leurs homologues américaines. Les entreprises aux États-Unis se concentrent principalement sur le marché intérieur en raison de la taille et de la portée des opportunités qui s’offrent à eux, et diversifient à un stade ultérieur lorsqu’elles dépassent les frontières du pays. Les startups européennes et asiatiques diversifient plus tôt en raison de la gamme de frontières et de cultures qu’elles traversent. Opérer sur un marché plus petit comporte en fait l’avantage d’un marché à plusieurs voix.

La technologie vocale est principalement conçue pour les locuteurs anglais – en partie en raison de ses racines de développement aux États-Unis, mais plus encore en raison de son statut de langue la plus parlée dans le monde. Pourtant, plus d’un milliard de personnes parlent anglais comme deuxième langue et rarement entendent des voix de marques qui reflètent leur accent en tant que locuteur étranger.

Avec la voix synthétique, les marques peuvent travailler avec des acteurs de voix qui parlent anglais comme deuxième langue, capturer facilement et avec précision leurs nuances vocales et déployer cet audio sur leurs campagnes de marketing. Non seulement les marques représenteront-elles plus de groupes sociaux, mais elles pourront également capitaliser sur des accents distincts et forts comme ceux des personnalités du divertissement Sofía Vergara (colombienne) et Arnold Schwarzenegger (autrichien).

Répliquer des accents plus diversifiés

Alors que le bassin d’acteurs de voix a augmenté ces dernières années, la démographie des acteurs est toujours une majorité de blancs et d’hommes. Il est donc difficile de trouver des voix qui ont des accents de petits ou de plus lointains endroits du monde, par exemple l’île de Malte.

Avec une technologie de clonage de voix personnalisée sophistiquée, les acteurs de voix de ces endroits (ou même les personnes du quotidien) peuvent lire un script spécifique dans un ton particulier, et enregistrer les très légères nuances dans leur accent. Ces accents peuvent ensuite être reproduits dans l’audio de la marque, permettant aux entreprises de localiser leur contenu et d’apporter des façons de parler moins connues à leur public.

Naturellement, la technologie est encore en développement et nécessite des heures d’enregistrements audio pour être robuste et sonner naturellement. Les modèles de voix fonctionnent mieux lorsqu’ils sont conçus pour des cas d’utilisation spécifiques comme la radio, la narration ou la publicité, les marques doivent donc prendre en compte le contexte dans lequel la voix sera appliquée, et affiner leur processus en conséquence. Le cycle est encore plus nuancé lorsque des accents rares sont produits, car les marques peuvent ne pas être en mesure de confirmer que l’intonation et la vitesse sont appropriées pour le scénario.

Il y a une raison pour laquelle le marché de la voix synthétique devrait être d’une valeur de 36 milliards de dollars d’ici 2025 ; c’est sa capacité à (littéralement) parler aux gens qui donne aux marques une ligne directe avec la vie quotidienne de leurs clients. Et en 2022, lorsque les gens veulent que les marques ressemblent et sonnent comme eux, la voix synthétique permet aux entreprises de transmettre plus de voix, plus fort, et sans perdre leur son d’origine.

Donner vie aux personnages de marque

La marque sonore est un outil puissant, en particulier parmi les publics plus jeunes et technophiles (qui sont également les plus vocaux pour dénoncer les marques qui ne sont pas diversifiées). En fait, des recherches menées au Royaume-Uni montrent que plus d’1 adulte sur 5 de moins de 35 ans sont plus susceptibles d’acheter un produit d’une marque, plus ils entendent le son associé à cette marque.

Mais l’audio n’a pas besoin d’être des personnes réelles pour être considéré comme diversifié. La voix synthétique peut réaliser des personnages fictifs qui s’adressent à des groupes de niche, incarnent certaines caractéristiques de personnalité ou sont simplement une extension amusante et instantanément reconnaissable de la marque. Regardez les likes de Tony the Tiger, Mrs Butterworth et la Laughing Cow.

La voix synthétique peut être conçue sur la base d’un ensemble de références qui construisent un personnage souhaité. Par exemple, si un personnage est fait de chocolat et doit sonner doux mais également un peu haletant comme s’il fond. La portée de la technologie donne aux marques une grande flexibilité créative, et est bénéfique pour établir une présence plus forte sur les plateformes de médias sociaux comme Instagram et TikTok, où les utilisateurs de la génération Z attendent des marques plus uniques et artistiques.

Dr. Timo Kunz est le co-fondateur et PDG de Aflorithmic - la première solution entièrement automatisable au monde pour la création de voix et d'audio de bout en bout à partir de texte.