Myslitelé
Budoucnost podcastingu je umělá inteligence

Přibližně 22 000 nových podcastů je spuštěno každý měsíc. V současné době je v adresáři Apple Podcasts téměř 2,5 milionu podcastů (více než 71 milionů epizod), podle Podcast Industry Insights. A to jsou pouze ty, o kterých víme.
“Mnozí podcastéři již nejsou závislí na velkých platformách. Přichází přímo k posluchačům, prodávají premium obsah a dosahují velkého úspěchu,” říká Andy Taylor, bývalý zaměstnanec BBC Radio a zakladatel kardiffské konzultace Bwlb.
A nemluvme již o rostoucím objemu podcastového obsahu, ať už vytvořeného značkami pro propagaci nebo producenty akcí, kteří chtějí například zpřístupnit přednášky na vyžádání. Každý obsah musí být vyroben a distribuován, ať už audio profesionály nebo lidmi, kteří se učí řemeslu. Čím více mohou automatizovat velké části produkce, tím více se mohou soustředit na obsah.
“Různá místa, kde je audio publikováno, prostě explodovala,” vysvětluje Jonathan Wyner, hlavní inženýr v M Works Mastering a profesor na Berklee College of Music v Bostonu. “S těmito kontexty je zde skutečná motivace a imperativ pro tvůrce, aby byli více všestranní.”
A nemluvme již o produktivitě a efektivitě.
Vzestup umělé inteligence
Umělá inteligence (AI) — software, který může automatizovat úkoly dříve prováděné lidmi — drží klíč k zvládnutí vlny podcastového obsahu. AI nejen urychluje produkci, ale také může zlepšit kvalitu podcastů a nastavit scénu pro audio zážitky zítřka.
“AI基本ně pomáhá s opakujícími se úkoly, aby urychlilo workflow podcastéra,” vysvětluje Manos Chourdakis, výzkumný inženýr v Nomono, který vyvíjí AI-založené podcastové nástroje. “Například s AI nemusíte poslouchat celý podcast, abyste našli místo, kde někdo řekl něco špatně, a poté ho nahradit nebo odstranit. Můžete to udělat sami, ale AI to dělá rychleji.”
Pak jsou zde úkoly, které lze vyřešit pouze pomocí AI — alespoň ve velkém měřítku, jako je odstranění šumu nebo vylepšení dialogu. “Kvalitní vylepšení dialogu by bylo nemožné bez AI,” říká Chourdakis. “Alespoň nemožné v rozumném časovém rámci pomocí tradičních nástrojů.”
Perfektní pro rutinní úkoly
Aplikace AI v podcastingu jsou stejně rozmanité jako úkoly produkce. Některé jsou přímo integrovány do podcastových platforem. Když tvůrci nahrávají své podcasty na hostingovou platformu Podcast.co, systém automaticky “poslouchá” audio soubory a normalizuje úroveň zvuku.
“Jakékoli nástroje, které mohou pomoci snížit nudné části práce, jsou dobré,” říká Mike Cunsolo, spoluzakladatel platformy. Cunsolo také provozuje Cue, produkční společnost pro podcasty, která spolupracuje s korporátními značkami, a Matchmaker.fm, která spojuje producenty podcastů s hosty. “Budete vždy potřebovat ten lidský expertní prvek, ale brzy mohou stroje naučit, co dělá podcast zajímavým, a snížit čas strávený úkolem.”
Poskytovatel řešení Descript aplikuje AI na mnoho aspektů podcastového inženýrství, včetně odstranění šumu a kontroly ozvěny. Jedním z více “nudných” úkolů, které Descript může zvládnout, je pokojový tón.
“Někdy producenti potřebují vložit digitální ticho do podcastu. Možná mezi editacemi nebo pro prodloužení mezery mezi větami,” říká Jay LeBoeuf, vedoucí obchodního a korporátního rozvoje v Descript. “Ale to zní naprosto nepřirozeně.”
Pokud producenti nezaznamenali pokojový tón, když byl podcast nahrán, mohou jít zpět a získat ho. Nebo mohou poslouchat záznam, kopírovat a vkládat, kde je třeba, a poté editovat výsledek, aby se přirozeně sladil.
Nebo počítače mohou zvládnout to. AI-založený generátor pokojového tónu Descript analyzuje záznam, identifikuje pokojový tón a automaticky ho syntetizuje, kde je třeba. Taková technologie nejen eliminuje rutinní úkoly, ale také umožňuje větší flexibilitu produkce.
“AI umožní, abychom používali levnější hardware, horší místnosti a hlučnější lokace a přesto dosáhli dobrých výsledků,” říká Chourdakis z Nomono.
Nové AI-založené schopnosti
AI také otevírá dveře inovacím v podcastingu — vytváří nové řešení, které zvyšují laťku pro podcastéry a posluchače. Například nástroj Epidemic Audio Reference (EAR) pomáhá podcastérům najít autorské právo zdarma na základě písní, které se jim líbí.
“Říkejme, že hledáte hudbu pro úvod nebo závěr a myslíte na konkrétní píseň, ale je chráněna autorským právem,” říká Chourdakis. “Systém používá AI, aby vám pomohl najít něco podobného.”
V Bwlb vyvinul Taylorův tým Accordion, AI-založené řešení, které může vzít podcast a reprodukovat ho v různých délkách.
“Každá jiná část našeho života se stává chytřejší — chytré domy, chytré ledničky,” říká Taylor. “Lidé chtějí více kontroly a pohodlí ze svého podcastového zážitku.”
Když Taylor pracoval na dokumentárních filmech pro BBC, byl požádán o kratší verze pro různé platformy. Proces byl vždy manuální. Accordion aplikuje softwareové algoritmy na podcastový obsah, aby inteligentně vytvořil verze různých délek. “Nesníží to nic,” říká Taylor, “ale dá uživateli kontrolu nad délkou obsahu bez ztráty tónu, struktury nebo poslouchatelnosti.”
Soustředění se na imerzivní vyprávění
Čím více podcastéři používají AI nástroje, tím lepší se stávají. Jinými slovy, čím více dat spotřebují, tím více se učí.
Algoritmy pro vylepšení dialogu Nomono jsou založeny na velkých datech hlasových nahrávek — některé čisté a srozumitelné, některé méně — které učí AI nástroje, jak generovat lepší zvuk. “Podcastéři by neměli potřebovat pokročilé audio znalosti, aby produkovali kvalitní audio,” říká Chourdakis. “Automatizací některých těchto úkolů mohou trávit více času soustředěním se na skvělé vyprávění a méně času na nudné úkoly.”
A v budoucnu mohou evoluce více snadno vytvářet nový žánr imerzivních, prostorových podcastů. Například technologie Nomono umožňuje objektově založenou produkci audio, která umožňuje producentům “umístit” hlasy do 3D zvukového prostoru nebo vytvořit dynamické verze, které lze přizpůsobit posluchačům.
“Mediální produkce nyní vstupuje do fáze, kde pokud si můžete něco představit, můžete to udělat,” říká LeBoeuf z Descript. “A již nemusíte mít drahé studio nebo desetiletí tréninku, abyste dosáhli svých cílů.”












