Líderes de opinión
Encontrar tu voz auténtica: Cómo la voz sintética puede compartir historias de marca con audiencias globales diversas

Casi dos tercios de las personas que se identifican con una minoría racial o étnica dicen que es más probable que interactúen con marcas que incluyen perspectivas diversas. Pero ser diverso es más que permitir que los clientes se vean a sí mismos en su marca, es dejar que también los escuchen.
El año pasado, el número de marcas que lanzaron identidades de audio por primera vez aumentó en 22%. Las empresas están intentando literalmente cortar el ruido en su industria y adaptar mejor su mensaje a todos los individuos a los que sirven. Pero mientras las marcas conocen las razones éticas y económicas para promover la diversidad en cualquier medio, no siempre conocen las herramientas para hacerlo a gran escala.
Aquí es donde entra en juego la voz sintética. La tecnología permite a las marcas comunicarse con las audiencias de una manera más inclusiva, y sin comprometer su autenticidad. Además, la facilidad de uso de la voz sintética significa que más marcas pueden utilizarla y representar a más personas. Aquí está por qué la voz sintética será el altavoz para más marcas diversas y sus historias.
Las empresas globales necesitan voces globales
La transformación digital masiva ha llevado a las marcas a ser globales desde el primer día. En una esfera empresarial predominantemente en línea, las empresas tienen que atender a clientes en múltiples ubicaciones y que hablan múltiples idiomas con diferentes acentos, dialectos y vocabulario. Independientemente del sector en el que esté, su base de usuarios probablemente se ha diversificado en los últimos años, y tiene que reflejar esa expansión en su marca sonora.
Las startups con sede en Europa y Asia pueden estar más preparadas para diversificarse que sus contrapartes estadounidenses. Las empresas en Estados Unidos tienden a centrarse principalmente en el mercado nacional debido al tamaño y alcance de la oportunidad allí, diversificándose en una etapa posterior cuando van más allá del país. Las startups europeas y asiáticas diversifican antes debido a la variedad de fronteras y culturas que cruzan. Operar en un mercado más pequeño viene con la ventaja de un mercado más multi-voz.
La tecnología de voz se construyó principalmente para hablantes de inglés, en parte debido a sus raíces de desarrollo en Estados Unidos, pero más porque es el idioma más hablado en el mundo. Sin embargo, más de mil millones de personas hablan inglés como segundo idioma y rara vez escuchan voces de marca que reflejen su acento como hablante extranjero.
Con la voz sintética, las marcas pueden trabajar con actores de voz que hablan inglés como segundo idioma, capturar fácil y precisamente sus matices vocales y desplegar ese audio en sus campañas de marketing. No solo las marcas representarán a más grupos sociales, sino que también podrán capitalizar acentos distintos y fuertes como los de las personalidades del entretenimiento Sofía Vergara (colombiana) y Arnold Schwarzenegger (austríaco).
Replicar acentos más diversos
Aunque el grupo de actores de voz ha crecido en los últimos años, la demografía de los actores sigue siendo una mayoría de hombres blancos. Por lo tanto, es difícil encontrar voces con acentos de lugares más pequeños o remotos del mundo, por ejemplo, la isla de Malta.
Con la tecnología de clonación de voz personalizada sofisticada, los actores de voz de estos lugares (o incluso personas comunes de allí) pueden leer un guión específico en un tono particular y grabar las pequeñas diferencias en su acento. Estos acentos luego se pueden replicar en el audio de la marca, lo que permite a las empresas localizar su contenido y llevar formas de hablar menos conocidas a sus audiencias.
Naturalmente, la tecnología todavía está en desarrollo y necesita horas de grabaciones de audio para ser robusta y sonar natural. Los modelos de voz funcionan mejor cuando se construyen para casos de uso específicos como la radio, la narración o la publicidad, por lo que las marcas deben tener en cuenta el contexto en el que se aplicará la voz y afinar su proceso en consecuencia. El ciclo es aún más matizado cuando se producen acentos raros, ya que las marcas pueden no poder confirmar fácilmente que la entonación y la velocidad sean adecuadas para el escenario.
Hay una razón por la que se predice que el mercado de la voz sintética valdrá $36 mil millones para 2025; su capacidad para (literalmente) hablar con las personas da a las marcas una línea directa a la vida diaria de sus clientes. Y en 2022, cuando la gente quiere que las marcas se parezcan y suenen como ellos, la voz sintética permite a las empresas transmitir más voces, más fuerte, y sin perder su sonido original.
Traer a la vida a los personajes de la marca
La marca sonora es una herramienta poderosa, especialmente entre las audiencias más jóvenes y tecnológicamente hábiles (que también son algunas de las más vocales en llamar a las marcas que no son diversas). De hecho, la investigación en el Reino Unido muestra que más de 1 de cada 5 adultos menores de 35 años es más probable que compren un producto de una marca, cuanto más escuchen el sonido asociado con esa marca.
Pero el audio no tiene que ser personas reales para ser considerado diverso. La voz sintética puede dar vida a personajes ficticios que hablan a grupos de nicho, encarnan ciertos rasgos de personalidad o son simplemente una extensión divertida y reconocible de la marca. Solo mire a personajes como Tony el Tigre, la Sra. Butterworth y la Vaca que Ríe.
La voz sintética puede diseñarse según un conjunto de credenciales que construyen un personaje deseado. Por ejemplo, si un personaje está hecho de chocolate y debe sonar dulce pero también un poco jadeante como si estuviera derritiéndose. El alcance de la tecnología da a las marcas mucha flexibilidad creativa, y es beneficioso para construir una presencia más fuerte en plataformas de redes sociales como Instagram y TikTok, donde los usuarios de la Generación Z esperan una marca más única y artística.












