Інтерв’ю

Бенджамін Дорр, генеральний директор WellSaid – Серія інтерв’ю

mm
Додайте Unite.AI до бажаних джерел у Google

Бенджамін Дорр є генеральним директором WellSaid і має понад 20 років досвіду роботи в ранньому етапі та зростанні компаній, в основному в галузі технологій. Незадовго до WellSaid Бенджамін був операційним директором Cordial, корпоративної платформи для маркетингу на декілька каналів, і двічі був обраний до списку Deloitte Fast 500. Він також обіймав посади в виконавчому складі компаній Valassis Digital, Rustic Pathways, Rhythm NewMedia та Counsyl. Бенджамін розпочав свою кар’єру в Citi, Morgan Stanley (MS ) та The Carlyle (CG ) Group, і має ступінь бакалавра Гарвардського університету за спеціальністю комп’ютерні науки та публічна політика.

З моменту заснування в 2019 році WellSaid використовує передові технології текст-у-голос для створення надзвичайно реалістичних, преміум-голосів AI, ретельно підбираючи професійних акторів озвучування та створюючи свою власну платформу AI. Компанія пропонує рішення, готові до використання в корпоративному секторі, такі як інструмент Studio для спільної створення озвучування та API для безшовної інтеграції, допомагаючи командам у сфері маркетингу, навчання, виробництва відео та розробки продуктів надавати послідовний, бренд-орієнтований аудіоконтент. Керівництво компанії керується сильними цінностями та принципами відповідальності AI,优 tiênізуючи довіру, якість та етичне використання для забезпечення захоплюючих, високих емоцій, достовірних аудіо-досвідів.

У вас була цікава кар’єра – від інвестиційного банку та венчурного капіталу до допомоги у масштабуванні компаній з місією. Як ці різні досвіди сформували ваш підхід до лідерства та бачення WellSaid?

До того, як я заснував свій перший стартап у 2006 році, я мав можливість досвідчувати підхід до лідерства, який сформував мій стиль управління. На початку своєї кар’єри я потрапив до компанії з чудовим інвестором на ім’я Ед Мاثіас, чий стиль лідерства та інвестування резонував зі мною. Він будував всіх навколо себе та вважав свою мережу своїм найбільшим активом. Він шукав діаманти в не ідеальному вигляді, крім консенсусних переможців, і стверджував, що оскільки існує багато способів заробити гроші, ви можете оптимізувати інші речі – інтелектуальну цікавість, людей, з якими вам подобається працювати, те, що допомагає світу тощо.

Голос AI розвинувся дуже швидко за останні кілька років. Яке найбільше стрибок вперед, на вашу думку, відбувається наступним – і як WellSaid готується до цього?

Універсальність. Коли якість голосу AI підвищується, кількість випадків використання збільшується, від внутрішньої комунікації один-до-багатьох, chẳng hạn як навчання та активація, до зовнішньої комунікації один-до-багатьох, chẳng hạn як маркетинг. Водночас основна вартість голосу AI наближається до рівня традиційного текст-у-голос, що означає, що більше людей можуть використовувати голос AI. З запуском Caruso – нашої останньої моделі – та нашого загального конвеєра даних ми просунуємося вперед у сфері інновацій як за якістю, так і за вартістю. Це одна з переваг бути вертикально інтегрованим в AI від набору даних до моделі до застосування.

Синтетичні голоси зараз є всюди – від аудіокниг до ботів обслуговування клієнтів. Як ви забезпечуєте, щоб голоси WellSaid залишилися довіреними та орієнтованими на людину в цьому швидкозростаючому просторі?

Люди знаходяться в центрі кожної аспекту WellSaid. Закрита технологія голосу WellSaid побудована на відповідально ліцензованих даних голосу від оплачених акторів. Але наші актори озвучування – це не лише навчальні дані, вони є справжніми співробітниками протягом всього процесу. А наші клієнти не просто тестувальники, вони є партнерами у розробці ідеального голосу для кожного застосування. Кожна функція на платформі WellSaid відображає це, надавши користувачам можливість перезаписати рядок, підкреслити слово або миттєво оновити контент без компромісу якості, послідовності чи прав.

Кожен голос готовий до виробництва та комерційно очищений для публічного або клієнтського контенту.

WellSaid підкреслює “відповідальне AI”. Що це означає на практиці при розробці нових моделей голосу?

WellSaid встановлює стандарт для відповідальності AI з потужною основою, центрованою навколо справедливості, прозорості, конфіденційності та безпеки, а також модерації контенту.

WellSaid наймає справжніх акторів озвучування, забезпечуючи їх явну, письмову згоду на надання даних голосу для платформи та компенсує їм справедливо з постійним розподілом доходу. Для захисту їхньої конфіденційності та безпеки WellSaid використовує запасні зображення та псевдоніми для представлення синтетичних голосів та заохочує їх бути обережними щодо спільного використання їхньої асоціації з WellSaid, щоб зменшити ризик того, що інші неправильно використовуватимуть їхній голос.

Для запобігання поширення дезінформації та аудіо-DeepFake від клонування голосу користувачі WellSaid не можуть завантажувати дані голосу від політиків, знаменитостей чи будь-кого іншого, якщо в WellSaid немає явної, письмової згоди цієї особи. WellSaid також підтримує суворі стандарти для відповідного контенту, забороняючи використання голосів для контенту, який є шкідливим, ненависним, шахрайським або призначеним для підбурювання до насильства.

WellSaid забезпечує, щоб контент завжди належав творцю, гарантуючи користувачам володіння інтелектуальною власністю та захистом авторських прав над матеріалом або контентом, створеним на платформі.

Через широкі захисти WellSaid встановлює галузеві очікування щодо того, яким повинно бути відповідальне використання голосу AI у виробництві.

WellSaid має на меті пропонувати “найвищу якість-до-вартості співвідношення” в галузі. Які інновації – технічні, операційні чи стратегічні – допоможуть вам виконати це обіцянку?

У WellSaid ми пріоритезуємо вертикальну інтеграцію всього нашого продуктивного конвеєра. У рамках Caruso хорошим прикладом є наш внутрішньо розроблений vocoder, який дозволяє нам тренувати з 1/10 кількості параметрів, ніж загальний інструмент, chẳng hạn як BigVGAN, і ми можемо робити це при подвійній якості аудіо. Стратегічно ми були свідомі щодо доставки якості над шириною (наприклад, пропонуючи кожну мову). Роблячи це, ми можемо втратити деякий бізнес, але це за рахунок доставки продукту вищої якості та нижчої вартості нашій основній аудиторії.

Як ви бачите розвиток ролі голосу AI в корпоративних умовах протягом наступних 3-5 років, коли на ринок надходять інструменти генерації AI?

AI не є абсолютно новим фронтиром, а частиною знайомого шаблону. Як підйом мобільних пристроїв або ранні інтернет, AI позначає зміну, яка викликає у команд挑ання щодо того, як створюється контент, як люди взаємодіють з програмним забезпеченням, і як голос представляє бренд.

За найближчі кілька років корпоративні компанії не зможуть уникнути голосу AI, як вони не могли уникнути інших технологічних революцій минулого. Коли якість голосу AI продовжує покращуватися, разом з нижчими витратами та простішими робочими процесами, ніж традиційний контент голосу акторів, голос AI стане стандартом для корпоративного контенту, chẳng hạn як реклама, навчання та розвиток, виробництво відео та більше.

Чи бачите ви майбутнє, в якому компанії глибоко персоналізують голос AI для бренд-ідентичності – можливо, навіть ліцензуючи голоси, як вони ліцензують музику чи персонажів сьогодні?

Багато компаній мають дуже відмінні голоси в своїй бренд-ідентичності, послідовно використовуючи той самий пам’ятний голос актора чи знаменитого представника по всьому контенту. Голос AI дозволяє будь-якій компанії побудувати таке саме визнання за меншу ціну. Голоси AI можуть бути такими ж динамічними та персоналізованими, як традиційне озвучування, і бренди скоро стануть синонімами своїх голосів AI – деякі вже стали.

Ви підкреслили важливість культури компанії та цінностей у побудові великих компаній. Як ви застосовуєте цю філософію зараз у WellSaid?

Я схильний погоджуватися з ідеєю, що велика культура – це робота з великими людьми, тому максимізація щільності талантів, впливу та хімії є всіма критичними ініціативами для нашої команди лідерів. Принципи WellSaid – це те, як ми намагаємось працювати разом, надавши дії для кожного члена команди, а не статичну добродійність. Наступні принципи допомагають нам досягти великої культури компанії:

  • Ми винаходимо технології, які революціонізують спосіб, у який люди працюють.

  • Ми діємо відповідально та прагнемо мінімізувати шкоду.

  • Ми ставимо клієнтів в центр всього, що ми робимо.

  • Ми поважаємо індивідуальність, визнаючи, що ми працюємо краще як команда.

  • Ми прагнемо побудувати велику компанію, якою ми завжди можемо бути горді.

Як ви думаєте про етичні наслідки створення голосів, які є нерозрізними від справжніх людей? Які обов’язки виходять з цього?

Хоча підйом AI приніс етичні виклики та проблеми, WellSaid вирішив пріоритезувати прозорість та відповідність з самого початку. Це наша відповідальність як компанії запобігти неправильному використанню, deepfake чи поширення дезінформації. Це включає роботу з талантами голосу для створення персоналізованих голосів, ліцензованих для конкретних випадків використання, встановлення чітких контролю над тим, хто може використовувати ці голоси, та для чого. Це також відповідальність брендів, які використовують голос AI, забезпечуючи, щоб вони співпрацювали з репутаційними постачальниками AI, які мають ці заходи безпеки.

Що вас найбільш цікавить у наступному розділі для WellSaid – і що, на вашу думку, буде сюрпризом для галузі щодо того, куди рухається голос AI?

Ми говоримо про кількість “Слів WellSaid” як про зірку північ для нашої команди. Я схильний бачити, як ці слова зростатимуть, коли більше компаній продовжуватимуть бачити цінність у голосі AI для доставки людоцентричних повідомлень своїм аудиторіям у масштабі. Коли використання голосу AI продовжуватиме розширюватися, люди будуть здивовані тим, наскільки безшовно буде впровадження цієї технології у широкий спектр випадків використання. Можливості безмежні для голосу AI та аудіо як інтерфейсу в програмному забезпеченні та фізичних середовищах.

Дякую за велике інтерв’ю, читачам, які бажають дізнатися більше, слід відвідати WellSaid

Антуан є видним лідером і засновником Unite.AI, який рухається незмінною пристрастю до формування та просування майбутнього штучного інтелекту та робототехніки. Як серійний підприємець, він вважає, що штучний інтелект буде таким же революційним для суспільства, як і електрика, і часто захоплюється потенціалом революційних технологій і штучного інтелекту загального призначення.

Як футуролог, він присвячений вивченню того, як ці інновації будуть формувати наш світ. Крім того, він є засновником Securities.io, платформи, орієнтованої на інвестиції в передові технології, які переінакшують майбутнє і змінюють цілі сектори.