AI-modeller og platforme

Suno lancerer Speech Beta, der kombinerer stemme og musik i én model

mm
Føj Unite.AI til dine foretrukne kilder på Google

Suno annoncerede Speech (beta) den 1. oktober 2026 og udgav en talende lydmodel, som virksomheden beskriver som den første, der kan generere stemme og musik sammen som et sammenhængende spor. Betaversionen blev gjort tilgængelig for alle brugere på mobil og web efter en måneds test med en lille gruppe.

Meddelelsen kom i et blogindlæg fra virksomheden skrevet af Chief Product Officer Jack Brody. Speech skaber talende lyd sat til original baggrundsmusik og er indbygget direkte i Suno: brugerne skriver en idé, et digt eller noget, de har skrevet, og beskriver derefter den stemme og den musikstil, de forestiller sig.

Et udgivelsesnotat dateret den 1. oktober 2026 beskriver Speech som den første model, der kan skabe tale og tilhørende soundtrack sammen i én optagelse, og mærker indlægget for Android, iOS, web og Create. Dets eksempler på, hvad brugere kan lave, inkluderer godnathistorier over blød piano, hype-taler over stadion-trommer og ASMR-indkøbslisten, og det angiver, at Speech er tilgængelig på mobil og web.

Suno indrammer lanceringen omkring, hvad de kalder kreativ underholdning, en kategori som virksomheden mener vil definere den næste bølge af forbrugerteknologi. Musik forbliver kernen i, hvad Suno bygger, skrev Brody, mens virksomhedens vision strækker sig til andre former for menneskelig udtryk. Indlægget beskriver Speech som et andet lærred for de personlige kreationer, fællesskabet allerede laver, og peger på sange, som brugere producerer til fødselsdage, bryllupper, interne jokes, tro og tilbedelse, deres børn og deres venner.

Tidlige anvendelser og angivne beta-begrænsninger

Ifølge indlægget eksperimenterede Sunos team uformelt med modellen under udviklingen, ved at omdanne venners sms-beskeder til dramatiske oplæsninger, give almindelige stemmemeddelelser episke soundtracks og lave meditationer, digte, motivationssnakke og godnathistorier til deres børn.

Suno advarede om, at betaen i praksis opfører sig som en sådan. En britisk accent kan lejlighedsvis glide over i en australsk og tilbage, skrev virksomheden, og “dramatiske pauser kan være meget dramatiske.” Suno sagde, at brugerne næsten sikkert vil opdage anvendelser, som teamet aldrig havde forestillet sig, og tilføjede, at denne form for opdagelse er pointen med at åbne betaen.

V6 og tidligere 2026-udgivelser

Speech følger en række Suno-udgivelser dokumenteret i 2026. Den 9. september 2026 introducerede virksomheden v6, en ny generation af musikmodeller udviklet med branchepartnerne Warner Music Group, BMG and Believe. Suno kaldte v6-modellerne for deres bedste hidtil og beskrev dem som hurtigere, mere udtryksfulde og af højere kvalitet. v6-familien består af tre modeller: flagskibet v6 og den udforskningsorienterede v6-wild, begge tilgængelige for Pro- og Premier-abonnenter, samt v6-mini, en hurtigere og mere effektiv version tilgængelig for alle.

Suno sagde, at v6 giver skabere mulighed for at redigere en del af en eksisterende sang ved hjælp af almindeligt sprog, bygge et mashup fra flere kilder i én forespørgsel, sample og isolere lyd for at skabe et nyt beat i en enkelt arbejdsgang, skabe musik ud fra tekst, lyd, billeder og video, samt opdatere en enkelt tekstlinje uden at genopbygge hele sangen. Et eksempel, virksomheden gav: ændring af et omkvæd, så det synges af et gospelkor.

Suno sagde, at deres team afholder ugentlige skrivelejre med kunstnere, producere, sangskrivere og musikere for at lære, hvordan de bruger Suno i deres kreative arbejdsgange, og at de har indført sikkerhedsforanstaltninger til at screene uploadede lydfiler og tekster for uautoriseret brug. Efterhånden som v6 rulles ud, sagde virksomheden, at de planlægger at pensionere deres tidligere modeller og flytte platformen helt over på v6-generationen. I samme meddelelse sagde Suno, at de udvikler opt‑in‑oplevelser bygget omkring individuelle kunstnere, hvor kunstnere kan vælge at deltage og blive betalt, når de gør det.

Tidligere indlæg i Sunos udgivelsesnoter dokumenterer resten af virksomhedens produktlinje for 2026. Suno lancerede v5.5 den 26. marts 2026, som driver tre funktioner: Voices, som lader brugerne optage eller uploade deres egen lyd og synge på deres kreationer; Custom Models, som træner en personlig version af v5.5 på mindst seks spor fra en brugers katalog; og My Taste, som over tid lærer en brugers foretrukne genrer, stemninger og referencer. Voices nåede iOS og Android den 7. august 2026, så brugerne kan optage en stemme én gang og bruge den på enhver sang.

Suno udgav Studio 2.0, en totalfornyelse af deres browserbaserede generative lydarbejdsstation med MIDI-redigering, lydeffekter, indbyggede synths og en chatlinje, til Premier-abonnenter den 13. august 2026. Yderligere Studio-opdateringer den 17. september 2026 gjorde MIDI-til-lyd-transskription hurtigere og mere præcis i forhold til det originale materiale.

Suno sagde, at de vil fortsætte med at forbedre Speech, efterhånden som de lærer, hvad folk elsker, hvad der endnu ikke fungerer helt, og hvad fællesskabet ønsker at gøre næste gang. Udgivelsesnotatet beder brugerne om feedback, efterhånden som funktionen forbedres over tid.

Luca Ren er en AI‑genereret analytiker hos Unite.AI, der dækker kunstig intelligens inden for underholdning, medier og digital historiefortælling. Hans arbejde undersøger, hvordan AI‑systemer kuraterer indhold, påvirker film‑, tv‑, musik‑ og spilsproduktion samt tilpasser medieoplevelser for globale publikum.

Med et kreativt og trendsensitivt perspektiv undersøger Luca, hvordan anbefalingsmotorer, generative værktøjer og publikumsanalyse omformer kreative arbejdsgange og distributionsmodeller. Han er især interesseret i, hvordan AI påvirker narrativ struktur, skaberautonomi og balancen mellem datadrevet optimering og kunstnerisk udtryk i moderne medieøkosystemer.

Artikler skrevet af Luca Ren er AI‑genererede og gennemgået af Unite.AI’s redaktionelle team for at sikre nøjagtighed, kulturel kontekst og ansvarlig dækning af AI’s udviklende rolle i underholdning og medier.