Лідери думок

Знаходження справжнього голосу: Як синтетичний голос може поділитися історіями брендів з різноманітними глобальними аудиторіями

mm
Додайте Unite.AI до бажаних джерел у Google

Близько двох третин людей, які ідентифікують себе з расовою або етнічною меншістю, кажуть, що вони більш схильні взаємодіяти з брендами, які включають різноманітні точки зору. Але бути різноманітним – це не тільки дозволити клієнтам бачити себе в вашому бренді, а й чути себе.

Минулого року кількість брендів, які вперше запустили аудіо-ідентичності, збільшилася на 22%. Компанії буквально намагаються прорватися через шум у своїй галузі і краще адаптувати свої повідомлення до всіх осіб, яких вони обслуговують. Але хоча бренди знають етичні та економічні причини для просування різноманітності будь-яким засобом, вони не завжди знають інструменти, які допоможуть їм зробити це у великому масштабі.

Вхід синтетичного голосу. Ця технологія дозволяє брендам спілкуватися з аудиторією більш інклюзивним чином – і без компромісу своєї автентичності. Крім того, легкість використання синтетичного голосу означає, що більше брендів можуть використовувати його і представляти більше людей. Ось чому синтетичний голос стане гучномовцем для більш різноманітних брендів і їхніх історій.

Глобальні компанії потребують глобальних голосів

Масова цифрова трансформація змусила бренди бути глобальними з дня заснування. У переважно онлайн-сфері бізнесу компанії повинні обслуговувати клієнтів у декількох місцях і з різними мовами, акцентами, діалектами та словником. Хто б ви не були, ваша база користувачів, ймовірно, розширилася за останні роки, і вам потрібно віддзеркалити це розширення у вашій звуковій брендингу.

Стартапи, розташовані в Європі та Азії, можливо, краще підготовлені до розмаїття, ніж їхні американські аналоги. Компанії у Сполучених Штатах зазвичай зосереджуються в основному на внутрішньому ринку через розмір і масштаб можливостей там, розмаїття на пізнішому етапі, коли вони виходять за межі країни. Євразійські стартапи розмаїтняться раніше через ряд кордонів і культур, які вони перетинають. Робота на меншому ринку насправді має перевагу більшого багатоголосого ринку.

Технологія голосу в основному побудована для англомовних користувачів – частково через коріння її розвитку у Сполучених Штатах, але більше через її статус найбільш розмовної мови у світі. Однак понад одна мільярд людей розмовляють англійською як другою мовою і рідко чують голоси брендів, які відображають їхній акцент як іноземного мовця.

З синтетичним голосом бренди можуть працювати з акторами голосу, які розмовляють англійською як другою мовою, легко і точно захоплювати їхні вокальні нюанси та розгортати цю аудіо у своїх маркетингових кампаніях. Не тільки бренди представлять більше соціальних груп, але й можуть капіталізувати відмінні, сильні акценти, як це роблять розважальні особистості Софія Вергара (колумбійська) і Арнольд Шварценеггер (австрійський).

Відтворити більш різноманітні акценти

Хоча басейн акторів голосу зростав за останні роки, демографія акторів все ще є білою, чоловічою більшістю. Тому складно знайти голоси з акцентами з менших або більш віддалених місць світу, наприклад, острову Мальти.

З допомогою складної технології кастомізації голосу актори з цих місць (або навіть звичайні люди з них) можуть прочитати певний сценарій у певному тоні, і мають дуже дрібні нюанси в їхньому акценті записані. Ці акценти потім можуть бути відтворені в аудіо бренду, що дозволяє компаніям локалізувати свій контент і привнести менш відомі способи спілкування до своєї аудиторії.

Природно, технологія все ще розвивається і потребує годин аудіозаписів, щоб бути надійною і звучати природно. Моделі голосу функціонують найкраще, коли вони побудовані для конкретних випадків використання, таких як радіо, розповідь або реклама, тому бренди повинні враховувати контекст, у якому буде застосовуватися голос, і відповідно до цього уточнювати свій процес. Цикл ще більш нюансирований, коли створюються рідкісні акценти, оскільки бренди можуть не мати можливості підтвердити, що інтонація і швидкість є відповідними для сценарію.

Є причина, чому ринок синтетичного голосу передбачається бути вартістю $36 млрд до 2025 року; це його здатність (буквально) говорити з людьми дає брендам прямий зв’язок з повсякденним життям клієнтів. І у 2022 році, коли люди хочуть, щоб бренди виглядали і звучали як вони, синтетичний голос дозволяє компаніям передавати більше голосів, голосніше, і без втрати свого оригінального звучання.

Привести персонажів бренду до життя

Звукова брендинг – це потужний інструмент, особливо серед молодих, техносавві аудиторій (які також є одними з найбільш голосних у виклику брендів, які не є різноманітними). Насправді дослідження у Великій Британії показує, що понад 1 з 5 дорослих під 35 років більш схильні придбати продукт бренду, чим більше вони чують звук, пов’язаний з цим брендом.

Але аудіо не обов’язково повинно бути реальними людьми, щоб бути вважаним різноманітним. Синтетичний голос може реалізувати вигаданих персонажів, які говорять до нішевих груп, охоплюють певні особистісні характеристики або просто є веселою, миттєво впізнаваною частиною бренду. Просто подивіться на таких, як Тоні Тигр, Місс Баттерворт і Сміюча Корова.

Синтетичний голос може бути розроблений на основі набору вимог, які конструюють бажаний персонаж. Наприклад, якщо персонаж складається з шоколаду і повинен звучати солодко, але також трохи здувається, як би він розтавав. Обсяг технології дає брендам багато творчої гнучкості, і є корисним для створення сильнішої присутності на соціальних платформах, таких як Instagram і TikTok, де користувачі покоління Z очікують більш унікального, художнього брендингу.

Dr. Timo Kunz є співзасновником і генеральним директором Aflorithmic - першого у світі повністю автоматизованого рішення для створення голосу та аудіо з тексту від початку до кінця.