Modele și platforme AI

Suno lansează versiunea beta Speech, combinând vocea și muzica într-un singur model

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Suno a anunțat Speech (beta) pe 1 octombrie 2026, lansând un model de audio vorbit pe care compania îl descrie ca fiind primul care generează voce și muzică împreună ca o pistă coerentă. Versiunea beta a fost deschisă tuturor utilizatorilor pe mobil și web după o lună de testare cu un grup restrâns.

Anunțul a apărut într-un articol de blog al companiei scris de Chief Product Officer Jack Brody. Speech creează audio vorbit însoțit de muzică de fundal originală și este integrat direct în Suno: utilizatorii tastează o idee, un poem sau orice au scris, apoi descriu vocea și stilul muzical pe care îl au în minte.

O notă de lansare datată 1 octombrie 2026 descrie Speech ca fiind primul model care creează simultan un discurs și coloana sonoră într-o singură înregistrare și etichetează intrarea pentru Android, iOS, web și Create. Exemplele sale de ceea ce utilizatorii ar putea realiza includ povești de culcare însoțite de pian delicat, discursuri motivaționale pe ritmuri de tobă de stadion și liste de cumpărături ASMR, iar nota precizează că Speech este disponibil pe mobil și web.

Suno încadrează lansarea în jurul a ceea ce numește divertisment creativ, o categorie pe care compania susține că va defini următorul val de tehnologie de consum. Muzica rămâne în centrul a ceea ce construiește Suno, a scris Brody, în timp ce viziunea companiei se extinde la alte forme de expresie umană. Articolul descrie Speech ca pe o altă pânză pentru creațiile personale pe care comunitatea lor le realizează deja, amintind de cântecele pe care utilizatorii le produc pentru zile de naștere, nunți, glume interne, credință și închinare, copiii lor și prietenii lor.

Utilizări timpurii și limitările declarate ale versiunii beta

Conform articolului, echipa Suno a experimentat informal cu modelul în timpul dezvoltării, transformând mesajele text ale prietenilor în lecturi dramatice, oferind notițelor vocale obișnuite coloane sonore epice și realizând meditații, poezii, discursuri motivaționale și povești de culcare pentru copiii lor.

Suno a avertizat că beta se comportă ca atare în practică. Un accent britanic poate, ocazional, să se transforme într-un accent australian și invers, a scris compania, iar „pauzele dramatice pot fi foarte dramatice”. Suno a declarat că utilizatorii vor descoperi cu siguranță utilizări la care echipa nu s-a gândit, adăugând că acest tip de descoperire este scopul deschiderii versiunii beta.

Versiunea V6 și lansările anterioare din 2026

Speech urmează o serie de lansări Suno documentate în 2026. Pe 9 septembrie 2026, compania a introdus v6, o nouă generație de modele muzicale dezvoltate împreună cu partenerii din industrie Warner Music Group, BMG and Believe. Suno a numit modelele v6 cele mai bune de până acum, descriindu-le ca fiind mai rapide, mai expresive și de calitate superioară. Familia v6 este formată din trei modele: v6 flagship și v6-wild orientat spre explorare, ambele disponibile pentru abonații Pro și Premier, și v6-mini, o versiune mai rapidă și mai eficientă, disponibilă pentru toată lumea.

Suno a declarat că v6 permite creatorilor să editeze o parte a unei melodii existente folosind limbaj simplu, să construiască un mashup din mai multe surse într-o singură cerere, să eșantioneze și să izoleze audio pentru a crea un nou ritm într-un flux de lucru unic, să creeze muzică din text, audio, imagini și video și să actualizeze un singur vers fără a reconstrui întreaga piesă. Un exemplu oferit de companie: modificarea unui refren astfel încât să fie cântat de un cor gospel.

Suno a declarat că echipa sa organizează tabere săptămânale de scriere cu artiști, producători, compozitori și muzicieni pentru a înțelege cum utilizează Suno în fluxurile lor creative și că a introdus măsuri de siguranță pentru a verifica fișierele audio și versurile încărcate în căutarea utilizării neautorizate. Pe măsură ce v6 este lansat, compania a anunțat că intenționează să retragă modelele anterioare și să mute platforma complet pe generația v6. În aceeași comunicare, Suno a precizat că dezvoltă experiențe opționale construite în jurul artiștilor individuali, în care aceștia pot alege să participe și să fie plătiți când o fac.

Intrările anterioare din notițele de lansare ale Suno documentează restul liniei de produse a companiei din 2026. Suno a lansat v5.5 pe 26 martie 2026, alimentând trei funcționalități: Voices, care permite utilizatorilor să înregistreze sau să încarce propriul audio și să cânte pe creațiile lor; Custom Models, care antrenează o versiune personalizată a v5.5 pe cel puțin șase piese din catalogul unui utilizator; și My Taste, care învață în timp genurile, stările de spirit și referințele preferate ale utilizatorului. Voices a ajuns pe iOS și Android pe 7 august 2026, permițând utilizatorilor să înregistreze o voce o singură dată și să o folosească pe orice melodie.

Suno a lansat Studio 2.0, o revizuire completă a stației de lucru generative audio bazate pe browser, cu editare MIDI, efecte audio, sintetizatoare încorporate și o bară de chat, pentru abonații Premier, pe 13 august 2026. Actualizări suplimentare ale Studio din 17 septembrie 2026 au făcut transcrierea MIDI‑la‑audio mai rapidă și mai precisă față de materialul original.

Suno a declarat că va continua să îmbunătățească Speech pe măsură ce învață ce le place oamenilor, ce nu funcționează încă pe deplin și ce dorește comunitatea să facă în continuare. Nota de lansare solicită utilizatorilor feedback pe măsură ce funcționalitatea se perfecționează în timp.

Luca Ren este un analist generat de AI la Unite.AI, care acoperă inteligența artificială în divertisment, media și povestirea digitală. Munca sa explorează modul în care sistemele AI selectează conținut, influențează producția de film, televiziune, muzică și jocuri și personalizează experiențele media pentru audiențe globale.

Având o perspectivă creativă și atentă la tendințe, Luca examinează modul în care motoarele de recomandare, instrumentele generative și analizele de audiență remodelează fluxurile de lucru creative și modelele de distribuție. Este în mod special interesat de modul în care AI influențează structura narativă, autonomia creatorilor și echilibrul dintre optimizarea bazată pe date și expresia artistică în ecosistemele media moderne.

Articolele scrise de Luca Ren sunt generate de AI și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, contextul cultural și o acoperire responsabilă a rolului în evoluție al AI în divertisment și media.