Finansiering
Mirelo hæver 41 millioner dollars i seed-runde for at bringe AI-genereret lyd til video, spil og mere

Berlin-baserede Mirelo har hævet en seed-runde på 41 millioner dollars, da de søger at løse en af de mest vedvarende blinde pletter i generativ medie: lyd. Finansieringen blev co-ledet af Index Ventures og Andreessen Horowitz, med deltagelse fra Atlantic.vc og TriplePoint Capital, hvilket understreger den voksende investeringsvilje til, at lyd er den næste store front for AI-dreven kreativitet.
Mens kunstig intelligens har hurtigt forandret, hvordan tekst, billeder og video produceres, er lyd blevet efterladt. Musik, lydeffekter og baggrundslyd er stadig arbejdskrævende og tilføjes ofte sent i den kreative proces, på trods af deres betydning for, hvordan indhold opfattes. Mirelos ambition er at ændre dette ved at gøre højkvalitets, emotionelt resonant lyd lige så let at generere som visuelle effekter.
Hvorfor lyd er blevet efterladt
Lyd har en unik evne til at forme følelse, spænding og atmosfære. En stum video, uanset hvor visuelt imponerende, føles sjældent komplet. Dog betyder tilføjelse af lyd for de fleste skabere at søge gennem stock-biblioteker, manuelt justere lydeffekter og iterere gennem tidslinjer, indtil alt føles rigtigt.
Dette mismatch er blevet mere tydeligt, da video-produktion accelererer. AI-genererede visuelle effekter, kortformet socialt indhold og adaptive spilmiljøer bevæger sig hurtigere end traditionelle lyd-arbejdsgange kan understøtte. Resultatet er en voksende kløft mellem, hvad skabere kan forestille sig visuelt og hvad de kan realistisk udføre lydmæssigt.
Mirelos grundlæggere så denne kløft ikke som en begrænsning af kreativitet, men som en begrænsning af værktøjer.
Opbygning af grundlæggende modeller for lyd
Stiftet i 2023 har Mirelo udviklet deres egne grundlæggende modeller, der er specielt designet til lyd i video. I stedet for at genbruge store sprogmodeller eller billed-baserede systemer, fokuserede virksomheden på lyd fra bunden. En bruger kan uploade en video og, inden for sekunder, modtage synkroniserede lydeffekter, der reagerer på bevægelse, timing og på-skærm-hændelser.
Dette tilgang er særligt relevant i miljøer, hvor indhold er dynamisk. AI-genererede videoer, personlige sociale feeds og moderne videospil alle har gavn af lyd, der kan tilpasse sig i realtid. Mirelos system genererer lyd hurtigere end i realtid, hvilket giver det mulighed for at følge med oplevelser, der ændrer sig på flyvet.
Virksomheden har nyligt udgivet Mirelo SFX v1.5, en video-til-lydeffekt-model, der er tilgængelig via deres selvbetjeningssystem og web-applikation, Mirelo Studio. Ifølge virksomheden er deres modeller letvægtige og kræver betydeligt mindre beregning end typiske store sprogmodeller, samtidig med at de leverer konkurrencedygtig eller overlegen lydkvalitet i eksterne evalueringer.
Musikere i hjertet af teknologien
En af Mirelos definerende karakteristika er deres grundlæggende hold. CEO CJ Simon-Gabriel og CTO Florian Wenzel er begge erfarne musikere samt erfarne AI-forskere. Simon-Gabriel har en ph.d. i maskinlæring og kausalt slutning fra Max Planck-instituttet og afsluttede en postdoc-stipendium ved ETH Zurich. Wenzel har en ph.d. i dyb læring fra Humboldt-universitetet og arbejdede tidligere som forsker ved Google (GOOGL ) Brain.
Musik har været en konstant parallel tråd i begges liv. Simon-Gabriel har trænet i klaver, orgel og komposition og har talt åbent om næsten at have forfulgt en musikkarriere professionelt. Wenzel spiller stadig el-guitar og producerer elektronisk musik som en del af en Berlin-baseret band.
Den dobbelte baggrund har formet Mirelos kultur og tekniske retning. I stedet for at behandle lyd som en sekundær output, tilgår holdet det som en primær kreativ medium, hvor matematisk præcision og udtryksfuld nuance må sameksistere.
Hvad kommer næste for AI-genereret lyd
Mirelos langsigtede ambition strækker sig langt ud over enkel automation. Virksomheden ser deres teknologi som en måde at fjerne friktion fra kreativt arbejde, håndtering af opgaver som synkronisering og timing, så kunstnere og lyddesignere kan fokusere på udtryk og fortælling.
Da visuelt indhold bliver mere personligt og interaktivt, vil lyd også skulle udvikle sig sideløbende. Spil, der tilpasser sig spilleradfærd, videoer genereret på forespørgsel og immersive virtuelle miljøer kræver alle lyd, der kan reagere dynamisk i stedet for at være fastlagt i forvejen.
Set fremad kan teknologier som Mirelos omdefinere, hvordan lyd skabes, deles og opleves. I stedet for statiske soundtracks kan lyd blive en levende komponent af visuelt medie, genereret i realtid for at matche kontekst, følelse og intention. I den fremtid er lyd ikke længere en eftertanke, men en integreret lag, der er direkte vævet ind i, hvordan historier fortælles på tværs af video, spil, film og fremvoksende digitale verdener.












