AI-modeller och plattformar
Suno lanserar Speech Beta, kombinerar röst och musik i en modell

Suno annonserade Speech (beta) den 1 oktober 2026 och släppte en talad ljudmodell som företaget beskriver som den första som genererar röst och musik tillsammans i ett sammanhängande spår. Betaversionen öppnades för alla användare på mobil och webb efter en månads testning med en liten grupp.
Tillkännagivandet kom i ett företagsblogginlägg skrivet av Chief Product Officer Jack Brody. Speech skapar talat ljud med original bakgrundsmusik och är inbyggt direkt i Suno: användare skriver in en idé, ett poem eller något de har skrivit, och beskriver sedan den röst och musikstil de har i åtanke.
En versionsanteckning daterad 1 oktober 2026 beskriver Speech som den första modellen som skapar tal och dess soundtrack tillsammans i ett tag, och märker inlägget för Android, iOS, webb och Create. Dess exempel på vad användare kan skapa inkluderar godnattsagor med mjuk piano, hype‑tal med stadiontrummor och ASMR‑inköpslistor, och den anger att Speech är tillgänglig på mobil och webb.
Suno presenterar lanseringen kring det de kallar kreativ underhållning, en kategori som företaget säger kommer definiera nästa våg av konsumentteknik. Musik förblir i centrum för vad Suno bygger, skrev Brody, medan företagets vision sträcker sig till andra former av mänskligt uttryck. Inlägget beskriver Speech som en annan duk för de personliga skapelser som deras community redan gör, och pekar på låtar som användare producerar för födelsedagar, bröllop, interna skämt, tro och tillbedjan, deras barn och deras vänner.
Tidiga användningsområden och angivna betabegränsningar
Enligt inlägget experimenterade Sunos team informellt med modellen under utvecklingen, omvandlade vänners textmeddelanden till dramatiska uppläsningar, gav vanliga röstmeddelanden episka soundtracks och skapade meditationer, dikter, uppmuntrande tal och godnattsagor för sina barn.
Suno varnade för att betaversionen beter sig som en sådan i praktiken. Ett brittiskt accent kan ibland glida över till ett australiensiskt och tillbaka, skrev företaget, och “dramatiska pauser kan bli mycket dramatiska.” Suno sade att användare nästan säkert kommer att upptäcka användningsområden som aldrig förelåg för teamet, och tillade att denna typ av upptäckt är poängen med att öppna betan.
V6 och tidigare 2026‑utgåvor
Speech följer en serie Suno‑utgåvor dokumenterade under 2026. Den 9 september 2026 introducerade företaget v6, en ny generation av musikmodeller utvecklade med branschpartnerna Warner Music Group, BMG and Believe. Suno kallade v6-modellerna för sina bästa hittills och beskrev dem som snabbare, mer uttrycksfulla och av högre kvalitet. v6‑familjen består av tre modeller: flaggskeppet v6 och den utforskningsinriktade v6‑wild, som båda är tillgängliga för Pro‑ och Premier‑prenumeranter, samt v6‑mini, en snabbare och mer effektiv version som är tillgänglig för alla.
Suno sade att v6 låter skapare redigera en del av en befintlig låt med enkelt språk, bygga ett mashup från flera källor i en enda begäran, sampla och isolera ljud för att skapa ett nytt beat i ett enda arbetsflöde, skapa musik från text, ljud, bilder och video, samt uppdatera en enskild textrad utan att bygga om hela låten. Ett exempel företaget gav: att ändra en refräng så att den sjungs av en gospelkör.
Suno sade att deras team håller veckovisa skrivläger med artister, producenter, låtskrivare och musiker för att lära sig hur de använder Suno i sina kreativa arbetsflöden, och att de har infört skyddsåtgärder för att granska uppladdade ljudfiler och texter för obehörig användning. När v6 rullas ut sade företaget att de planerar att pensionera sina tidigare modeller och flytta plattformen helt till v6‑generationen. I samma tillkännagivande sade Suno att de utvecklar frivilliga upplevelser byggda kring enskilda artister, där artister kan välja att delta och bli betalda när de gör det.
Tidigare poster i Sunos release‑anteckningar dokumenterar resten av företagets produktlinje för 2026. Suno lanserade v5.5 den 26 mars 2026, med tre funktioner: Voices, som låter användare spela in eller ladda upp eget ljud och sjunga på sina skapelser; Custom Models, som tränar en personlig version av v5.5 på minst sex spår från en användares katalog; och My Taste, som lär sig en användares föredragna genrer, stämningar och referenser över tid. Voices nådde iOS och Android den 7 augusti 2026, vilket gör det möjligt för användare att spela in en röst en gång och använda den i vilken låt som helst.
Suno släppte Studio 2.0, en total översyn av deras webbläsarbaserade generativa ljudarbetsstation med MIDI‑redigering, ljudeffekter, inbyggda syntar och ett chattfält, för Premier‑prenumeranter den 13 augusti 2026. Ytterligare Studio‑uppdateringar den 17 september 2026 gjorde MIDI‑till‑ljud‑transkription snabbare och mer exakt i förhållande till originalmaterialet.
Suno sade att de kommer fortsätta förbättra Speech i takt med att de lär sig vad folk älskar, vad som ännu inte fungerar helt, och vad communityn vill göra härnäst. Versionsanteckningen ber användare om feedback när funktionen förbättras över tid.












