Лидеры мнений

Будущее подкастинга – это ИИ

mm
Добавьте Unite.AI в избранные источники в Google

Примерно 22 000 новых подкастов запускаются каждый месяц. Сейчас в каталоге Apple Podcasts есть около 2,5 миллионов подкастов (более 71 миллиона эпизодов), согласно Podcast Industry Insights. И это только те, о которых мы знаем.

«Многие подкастеры сейчас не проходят через крупные платформы. Они напрямую обращаются к слушателям, продают премиум-контент и добиваются большого успеха», – говорит Энди Тейлор, бывший сотрудник BBC Radio и основатель кардиффской исследовательской компании Bwlb.

И это не говоря уже о растущем объеме контента, похожего на подкасты, создаваемого брендами для продвижения или организаторами мероприятий, которые хотят, например, сделать доклады доступными по требованию. Каждый кусок контента необходимо производить и распространять, будь то профессионалами аудио или людьми, изучающими это ремесло. Поэтому чем больше они могут автоматизировать большие участки производства, тем больше они могут сосредоточиться на контенте.

«Места, где публикуется аудио, просто взорвались», – объясняет Джонатан Вайнер, главный инженер в M Works Mastering и профессор Беркли-колледжа музыки в Бостоне. «С учетом всех этих контекстов есть реальная мотивация и императив для создателей быть более универсальными».

Не говоря уже о том, что они становятся более продуктивными и эффективными.

Рост ИИ

Искусственный интеллект (ИИ) – программное обеспечение, которое может автоматизировать задачи, ранее выполняемые людьми, – держит ключ к управлению цунами контента подкастов. ИИ не только может ускорить производство, но и сделать подкасты звучать лучше и подготовить сцену для аудио-опыта завтрашнего дня.

«ИИ по сути помогает справиться с повторяющимися задачами, чтобы ускорить рабочий процесс подкастера», – объясняет Манос Чурдакис, исследовательский инженер в Nomono, которая разрабатывает инструменты для подкастинга на основе ИИ. «Например, с ИИ вам не нужно слушать весь подкаст, чтобы найти, где кто-то сказал что-то неправильно, а затем заменить или удалить это. Вы можете сделать это сами, но ИИ делает это быстрее».

Затем есть задачи, которые можно выполнить только с помощью ИИ – по крайней мере, в масштабе, например, удаление шума или улучшение диалога. «Качественное улучшение диалога было бы невозможно без ИИ», – говорит Чурдакис. «По крайней мере, невозможно в разумном временном интервале с помощью традиционных инструментов».

Идеально для рутинных задач

Применения ИИ в подкастинге так же разнообразны, как и задачи производства. Некоторые из них встроены直接 в платформы для подкастов. Когда создатели загружают свои подкасты на хостинговую платформу Podcast.co, система автоматически «слушает» аудиофайлы и нормализует уровни звука.

«Любой инструмент, который может помочь уменьшить скучные части работы, – это хорошая вещь», – говорит Майк Кунсоло, сооснователь платформы. Кунсоло также управляет Cue, компанией по производству подкастов, работающей с брендами, и Matchmaker.fm, которая соединяет производителей подкастов с гостями. «Вам всегда понадобится этот элемент человеческой экспертизы, но скоро машины смогут научиться понимать, что делает подкаст интересным, и уменьшить время на задачу».

Поставщик решений Descript применяет ИИ к многим аспектам инженерии подкастов, включая удаление шума и контроль эха. Одна из более «скучных» задач, которую может выполнить Descript, – это тон комнаты.

«Иногда продюсеры нужно вставить цифровое молчание в подкаст. Может быть, между редакциями или чтобы растянуть расстояние между предложениями», – говорит Джей Лебо, глава бизнеса и корпоративного развития в Descript. «Но это звучит невероятно неестественно».

Если продюсеры не захватили тон комнаты, когда записывали подкаст, они могут вернуться и получить его. Или они могут слушать его в записи, копировать и вставлять, где необходимо, а затем редактировать результат, чтобы он звучал естественно.

Или компьютеры могут справиться с этим. Генератор тона комнаты Descript на основе ИИ анализирует запись, определяет тон комнаты и автоматически синтезирует его, где это необходимо. Такая технология не только устраняет рутинные задачи, но и позволяет добиться большей гибкости производства.

«ИИ позволит нам использовать менее дорогое оборудование, хуже звучащие комнаты и более шумные места и все равно получать хорошие результаты», – говорит Чурдакис из Nomono.

Новые возможности на основе ИИ

ИИ также открывает двери к инновациям в подкастинге – созданию новых решений, которые повышают планку для подкастеров и слушателей. Например, инструмент Epidemic Audio Reference (EAR) помогает подкастерам найти музыку без копирайта на основе песен, которые им нравятся.

«Допустим, вы ищете музыку для интро или аутро, и вы думаете о конкретной песне, но она защищена авторским правом», – говорит Чурдакис. «Система использует ИИ под капотом, чтобы помочь вам найти что-то подобное».

В Bwlb команда Тейлора разработала Accordion, решение на основе ИИ, которое может взять подкаст и воспроизвести его разной длины.

«Каждая другая часть нашей жизни становится умнее – умные дома, умые холодильники», – говорит Тейлор. «Люди хотят больше контроля и удобства от своего опыта подкастинга».

Когда Тейлор работал над документальными фильмами для BBC, его просили сделать более короткие версии для разных платформ. Процесс всегда был ручным. Accordion применяет программные алгоритмы к контенту подкаста, чтобы интеллектуально создать версии разной длины. «Это не ускоряет ничего», – говорит Тейлор, «но дает пользователю контроль над продолжительностью контента без потери тональной структуры или слушаемости».

Фокус на погружающем рассказывании

Чем больше подкастеры используют инструменты ИИ, тем лучше они становятся. Другими словами, чем больше данных они потребляют, тем больше они учатся.

Алгоритмы улучшения диалога Nomono основаны на больших наборах данных голосовых записей – некоторых чистых и понятных, некоторых менее таковых – которые учат инструменты ИИ, как генерировать лучший звук. «Подкастерам не нужно иметь продвинутые знания аудио, чтобы производить высококачественный аудио», – говорит Чурдакис. «Автоматизируя некоторые из этих задач, они могут потратить больше времени на создание отличных историй и меньше времени на скучные задачи по очистке».

И в будущем они смогут эволюционировать, чтобы создать новый жанр погружающих, пространственных подкастов. Например, технология Nomono позволяет производить объектно-ориентированный аудио, который позволяет продюсерам «разместить» голоса в 3D-звуковом пейзаже или создать динамические версии, которые можно адаптировать к слушателям.

«Производство медиа сейчас входит в фазу, когда если вы можете мечтать об этом, это может произойти», – говорит Лебо из Descript. «И вам больше не нужно иметь дорогую студию или десятилетия тренировок, чтобы достичь своих целей».

Брэд Граймс - давний журналист в области технологий и бывший директор по коммуникациям Ассоциации аудиовизуальных и интегрированных trải nghiệm.