AI-modeller og plattformer
Suno lanserer Speech Beta, som parer stemme og musikk i én modell

Suno kunngjorde Speech (beta) 1. oktober 2026, og lanserte en tale‑audio‑modell som selskapet beskriver som den første som genererer stemme og musikk sammen som ett sammenhengende spor. Betaversjonen ble gjort tilgjengelig for alle brukere på mobil og nett etter en måned med testing i en liten gruppe.
Kunngjøringen kom i et bedriftsblogginnlegg skrevet av Chief Product Officer Jack Brody. Speech lager talte lydspor satt til original bakgrunnsmusikk og er bygget direkte inn i Suno: brukere skriver inn en idé, et dikt eller noe de har skrevet, og beskriver deretter stemmen og musikstilen de har i tankene.
Et utgivelsesnotat datert 1. oktober 2026 beskriver Speech som den første modellen som skaper tale og tilhørende lydspor sammen i ett opptak, og merker innlegget for Android, iOS, nett og Create. Eksempler på hva brukere kan lage inkluderer godnatthistorier over myk piano, hype‑taler over stadion‑trommer, og ASMR‑handlelister, og det står at Speech er tilgjengelig på mobil og nett.
Suno rammer inn lanseringen rundt det de kaller kreativ underholdning, en kategori selskapet mener vil definere neste bølge av forbrukerteknologi. Musikk forblir kjernen i det Suno bygger, skrev Brody, mens selskapets visjon strekker seg til andre former for menneskelig uttrykk. Innlegget beskriver Speech som et nytt lerret for de personlige skapelsene fellesskapet allerede lager, med eksempler på sanger brukere produserer for bursdager, bryllup, interne vitser, tro og tilbedelse, deres barn og venner.
Tidlige bruksområder og oppgitte betabegrensninger
Ifølge innlegget eksperimenterte Sunos team uformelt med modellen under utviklingen, ved å gjøre venners tekstmeldinger om til dramatiske opplesninger, gi vanlige talebeskjeder episke lydspor, og lage meditasjoner, dikt, motivasjonsprat og godnatthistorier for barna sine.
Suno advarte om at betaversjonen oppfører seg som en slik i praksis. Et britisk aksent kan av og til gli over i en australsk og tilbake, skrev selskapet, og «dramatiske pauser kan bli svært dramatiske». Suno sa at brukere sannsynligvis vil oppdage bruksområder som aldri forekom teamet, og la til at denne typen oppdagelser er poenget med å åpne betaversjonen.
V6 og tidligere 2026-utgivelser
Speech følger en rekke Suno-utgivelser dokumentert i 2026. 9. september 2026 introduserte selskapet v6, en ny generasjon musikkmodeller utviklet med bransjepartnere Warner Music Group, BMG og Believe. Suno kalte v6-modellene sine beste hittil, og beskrev dem som raskere, mer uttrykksfulle og av høyere kvalitet. v6-familien består av tre modeller: flaggskipet v6 og den utforskningsorienterte v6-wild, begge tilgjengelige for Pro‑ og Premier‑abonnenter, samt v6-mini, en raskere og mer effektiv versjon tilgjengelig for alle.
Suno sa at v6 lar skapere redigere en del av en eksisterende sang ved hjelp av naturlig språk, bygge en mashup fra flere kilder i én forespørsel, sample og isolere lyd for å lage en ny beat i en enkelt arbeidsflyt, lage musikk fra tekst, lyd, bilder og video, samt oppdatere en enkelt tekstlinje uten å bygge hele sangen på nytt. Et eksempel selskapet ga: endre et refreng slik at det blir sunget av et gospelkor.
Suno opplyste at teamet holder ukentlige skrive‑leirer med artister, produsenter, låtskrivere og musikere for å lære hvordan de bruker Suno i sine kreative arbeidsflyter, og at de har innført sikkerhetstiltak for å sjekke opplastede lydfiler og tekster for uautorisert bruk. Etter hvert som v6 rulles ut, sa selskapet at de planlegger å avvikle de tidligere modellene og flytte plattformen helt over på v6‑generasjonen. I samme kunngjøring sa Suno at de utvikler frivillige opplevelser bygget rundt enkeltartister, hvor artister kan velge å delta og bli betalt når de gjør det.
Tidligere oppføringer i Sunos utgivelsesnotater dokumenterer resten av selskapets 2026-produktlinje. Suno lanserte v5.5 26. mars 2026, som driver tre funksjoner: Voices, som lar brukere ta opp eller laste opp sin egen lyd og synge på sine skapelser; Custom Models, som trener en personlig versjon av v5.5 på minst seks spor fra en brukers katalog; og My Taste, som over tid lærer seg en brukers foretrukne sjangre, stemninger og referanser. Voices ble tilgjengelig på iOS og Android 7. august 2026, og gjør det mulig for brukere å ta opp en stemme én gang og bruke den på hvilken som helst sang.
Suno lanserte Studio 2.0, en totaloppgradering av sin nettleserbaserte generative lydarbeidsstasjon med MIDI‑redigering, lydeffekter, innebygde synths og en chat‑linje, for Premier‑abonnenter 13. august 2026. Videre Studio‑oppdateringer 17. september 2026 gjorde MIDI‑til‑audio‑transkripsjon raskere og mer nøyaktig i forhold til originalmaterialet.
Suno sa at de vil fortsette å forbedre Speech etter hvert som de lærer hva folk elsker, hva som ennå ikke fungerer helt, og hva fellesskapet ønsker å gjøre videre. Utgivelsesnotatet ber brukerne om tilbakemelding mens funksjonen forbedres over tid.












