Finansiering
Mirelo tar in 41 miljoner dollar i seedfinansiering för att ta AI-genererad ljud till video, spel och bortom

Berlinbaserade Mirelo har tagit in 41 miljoner dollar i seedfinansiering när de siktar på att lösa en av de mest bestående blind fläckarna inom generativ media: ljud. Finansieringen leddes av Index Ventures och Andreessen Horowitz, med deltagande från Atlantic.vc och TriplePoint Capital, vilket understryker den växande investerartron att ljud är den nästa stora fronten för AI-driven kreativitet.
Medan artificiell intelligens snabbt har förändrat hur text, bilder och video produceras, har ljud halkat efter. Musik, ljudeffekter och bakgrundsljud förblir arbetsintensiva, ofta tillagda sent i skapandeprocessen trots deras överdimensionerade inflytande på hur innehåll uppfattas. Mirelos ambition är att ändra på detta genom att göra högkvalitativt, emotionellt resonant ljud lika lätt att generera som visuella effekter.
Varför ljud har lämnats efter
Ljud har en unik förmåga att forma känslor, spänning och atmosfär. En tyst video, oavsett hur visuellt imponerande, känns sällan komplett. Ändå innebär det för de flesta skapare att lägga till ljud fortfarande att söka igenom lager, manuellt justera ljud-effekter och iterera genom tidsaxlar tills allt känns rätt.
Denna missmatch har blivit mer uppenbar när video-skapande accelererar. AI-genererade visuella effekter, korta sociala innehåll och adaptiva spelmiljöer rör sig alla snabbare än traditionella ljudflöden kan stödja. Resultatet är en växande klyfta mellan vad skapare kan föreställa sig visuellt och vad de kan realistiskt utföra soniskt.
Mirelos grundare såg denna klyfta inte som en begränsning av kreativitet, utan som en begränsning av verktyg.
Att bygga grundläggande modeller för ljud
Grundat 2023 har Mirelo utvecklat sina egna grundläggande modeller som är speciellt utformade för ljud i video. Istället för att återanvända stora språkmodeller eller bildbaserade system, fokuserade företaget på ljud från grunden. En användare kan ladda upp en video och, inom några sekunder, få synkroniserade ljud-effekter som svarar på rörelse, timing och skärmbaserade händelser.
Denna tillvägagångssätt är särskilt relevant i miljöer där innehåll är dynamiskt. AI-genererade videor, personliga sociala flöden och moderna videospel alla dra nytta av ljud som kan anpassa sig i realtid. Mirelos system genererar ljud snabbare än i realtid, vilket gör det möjligt att hålla jämna steg med upplevelser som ändras på flyget.
Företaget släppte nyligen Mirelo SFX v1.5, en video-till-ljud-effekt-modell som är tillgänglig via dess självbetjänings-API och webbapplikation, Mirelo Studio. Enligt företaget är deras modeller lätta, kräver betydligt mindre beräkningskraft än typiska stora språkmodeller samtidigt som de levererar konkurrenskraftig eller överlägsen ljudkvalitet i externa utvärderingar.
Musiker i kärnan av teknologin
En av Mirelos karakteristiska drag är dess grundarteam. VD CJ Simon-Gabriel och CTO Florian Wenzel är båda erfarna musiker samt erfarna AI-forskare. Simon-Gabriel har en doktorsexamen i maskinlärning och kausalt inferens från Max Planck-institutet och avslutade en postdoktorand vid ETH Zürich. Wenzel avlade sin doktorsexamen i djupinlärning från Humboldt-universitetet och arbetade tidigare som forskare vid Google (GOOGL ) Brain.
Musik har varit en konstant parallell tråd i båda deras liv. Simon-Gabriel utbildade sig i piano, orgel och komposition och har talat öppet om att nästan ha följt en musikkarriär. Wenzel fortsätter att spela elgitarr och producera elektronisk musik som en del av en Berlin-baserad grupp.
Denna dubbla bakgrund har format Mirelos kultur och tekniska riktning. Istället för att behandla ljud som en sekundär utdata, närmar sig teamet det som en primär kreativ medium, där matematisk precision och uttrycksfull nyans måste samexistera.
Vad som kommer härnäst för AI-genererat ljud
Mirelos långsiktiga ambition sträcker sig långt bortom enkel automatisering. Företaget ser sin teknik som ett sätt att ta bort friktion från kreativt arbete, hantera uppgifter som synkronisering och timing så att konstnärer och ljudformgivare kan fokusera på uttryck och berättande.
När visuellt innehåll blir mer personligt och interaktivt, kommer ljud att behöva utvecklas parallellt. Spel som anpassar sig till spelarbeteende, videor genererade på begäran och immersiva virtuella miljöer kräver alla ljud som kan svara dynamiskt snarare än att vara fastställt i förväg.
Att se framåt, teknologier som Mirelos kunde omdefiniera hur ljud skapas, delas och upplevs. Istället för statiska ljudspår, kan ljud bli en levande komponent i visuella medier, genererat i realtid för att matcha sammanhang, känslor och avsikt. I den framtiden är ljud inte längre en eftertanke, utan en integrerad lager som vävs direkt in i hur berättelser berättas över video, spel, film och framväxande digitala världar.












