Modelli e piattaforme di IA

Suno lancia Speech Beta, accoppiando voce e musica in un unico modello

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

Suno ha annunciato Speech (beta) il 1 ottobre 2026, rilasciando un modello di audio parlato che l’azienda descrive come il primo a generare voce e musica insieme in un unico brano coeso. La beta è stata aperta a tutti gli utenti su mobile e web dopo un mese di test con un piccolo gruppo.

L’annuncio è stato pubblicato in un post sul blog aziendale scritto dal Chief Product Officer Jack Brody. Speech crea audio parlato accompagnato da musica di sottofondo originale ed è integrato direttamente in Suno: gli utenti digitano un’idea, una poesia o qualcosa che hanno scritto, quindi descrivono la voce e lo stile musicale che hanno in mente.

Una nota di rilascio del 1 ottobre 2026 descrive Speech come il primo modello a creare un discorso e la sua colonna sonora insieme in un’unica ripresa, e associa l’entry ad Android, iOS, web e Create. I suoi esempi di ciò che gli utenti potrebbero realizzare includono storie della buonanotte su pianoforte delicato, discorsi motivazionali su percussioni da stadio e liste della spesa ASMR, e afferma che Speech è disponibile su mobile e web.

Suno inquadra il lancio attorno a quello che chiama intrattenimento creativo, una categoria che l’azienda afferma definirà la prossima ondata di tecnologia consumer. La musica rimane al centro di ciò che Suno costruisce, ha scritto Brody, mentre la visione dell’azienda si estende ad altre forme di espressione umana. Il post descrive Speech come un’altra tela per le creazioni personali che la sua comunità realizza già, facendo riferimento a canzoni che gli utenti producono per compleanni, matrimoni, battute interne, fede e culto, i loro figli e i loro amici.

Primevoli usi e limitazioni dichiarate della beta

Secondo il post, il team di Suno ha sperimentato il modello in modo informale durante lo sviluppo, trasformando i messaggi di testo degli amici in letture drammatiche, aggiungendo colonne sonore epiche alle normali note vocali e creando meditazioni, poesie, discorsi motivazionali e storie della buonanotte per i loro figli.

Suno ha avvertito che la beta si comporta come tale nella pratica. Un accento britannico può occasionalmente trasformarsi in uno australiano e viceversa, ha scritto l’azienda, e “le pause drammatiche possono essere molto drammatiche”. Suno ha affermato che gli utenti scopriranno quasi certamente usi che non erano mai venuti in mente al team, aggiungendo che questo tipo di scoperta è lo scopo dell’apertura della beta.

Rilasci V6 e precedenti del 2026

Speech segue una serie di rilasci Suno documentati nel 2026. Il 9 settembre 2026, l’azienda ha introdotto v6, una nuova generazione di modelli musicali sviluppata con i partner del settore Warner Music Group, BMG and Believe. Suno ha definito i modelli v6 i migliori finora, descrivendoli come più veloci, più espressivi e di qualità superiore. La famiglia v6 è composta da tre modelli: il modello di punta v6 e il v6-wild orientato all’esplorazione, entrambi disponibili per gli abbonati Pro e Premier, e v6-mini, una versione più veloce ed efficiente disponibile per tutti.

Suno ha dichiarato che v6 consente ai creatori di modificare una parte di una canzone esistente usando un linguaggio semplice, di creare un mashup da più fonti in un’unica richiesta, di campionare e isolare l’audio per costruire un nuovo beat in un unico flusso di lavoro, di creare musica da testo, audio, immagini e video, e di aggiornare un singolo verso senza ricostruire l’intera canzone. Un esempio fornito dall’azienda: modificare un ritornello affinché venga cantato da un coro gospel.

Suno ha affermato che il suo team organizza campi di scrittura settimanali con artisti, produttori, cantautori e musicisti per apprendere come utilizzano Suno nei loro flussi di lavoro creativi, e che ha introdotto misure di sicurezza per controllare i file audio e i testi caricati alla ricerca di usi non autorizzati. Con il lancio di v6, l’azienda ha dichiarato di pianificare il ritiro dei modelli precedenti e di trasferire l’intera piattaforma sulla generazione v6. Nello stesso annuncio, Suno ha detto di stare sviluppando esperienze opt-in costruite attorno a singoli artisti, in cui gli artisti possono scegliere di partecipare e di essere pagati quando lo fanno.

Le precedenti voci in le note di rilascio di Suno documentano il resto della linea di prodotti dell’azienda per il 2026. Suno ha lanciato v5.5 il 26 marzo 2026, alimentando tre funzionalità: Voices, che consente agli utenti di registrare o caricare il proprio audio e cantare sulle proprie creazioni; Custom Models, che addestra una versione personalizzata di v5.5 su almeno sei tracce dal catalogo dell’utente; e My Taste, che apprende nel tempo i generi, gli umori e i riferimenti preferiti dell’utente. Voices è arrivato su iOS e Android il 7 agosto 2026, permettendo agli utenti di registrare una voce una sola volta e usarla su qualsiasi canzone.

Suno ha rilasciato Studio 2.0, una revisione completa della sua workstation audio generativa basata su browser con editing MIDI, effetti audio, sintetizzatori integrati e una barra di chat, per gli abbonati Premier il 13 agosto 2026. Ulteriori aggiornamenti di Studio il 17 settembre 2026 hanno reso la trascrizione da MIDI a audio più veloce e più accurata rispetto al materiale originale.

Suno ha dichiarato che continuerà a migliorare Speech man mano che apprende cosa piace alle persone, cosa non funziona ancora del tutto e cosa la comunità desidera fare in futuro. La nota di rilascio chiede agli utenti un feedback mentre la funzionalità migliora nel tempo.

Luca Ren è un analista generato da AI presso Unite.AI, che si occupa di intelligenza artificiale nell'intrattenimento, nei media e nella narrazione digitale. Il suo lavoro esplora come i sistemi di AI curano i contenuti, influenzano la produzione di film, televisione, musica e videogiochi, e personalizzano le esperienze mediatiche per il pubblico globale.

Con una prospettiva creativa e attenta alle tendenze, Luca esamina come i motori di raccomandazione, gli strumenti generativi e le analisi del pubblico stiano rimodellando i flussi di lavoro creativi e i modelli di distribuzione. È particolarmente interessato a come l'AI influisca sulla struttura narrativa, sull'autonomia dei creatori e sull'equilibrio tra ottimizzazione guidata dai dati e espressione artistica nei moderni ecosistemi mediatici.

Gli articoli scritti da Luca Ren sono generati da AI e revisionati dal team editoriale di Unite.AI per garantire accuratezza, contesto culturale e una copertura responsabile del ruolo in evoluzione dell'AI nell'intrattenimento e nei media.