Моделі та платформи ШІ

Suno запускає Speech Beta, поєднуючи голос і музику в одній моделі

mm
Додайте Unite.AI до бажаних джерел у Google

Suno оголосив Speech (beta) 1 жовтня 2026 року, випустивши модель озвученого аудіо, яку компанія описує як першу, що генерує голос і музику разом в одному цілісному треку. Бета була відкритою для всіх користувачів на мобільних пристроях та в веб‑версії після місяця тестування з невеликою групою.

Оголошення було розміщено у блозі компанії, написаному головним продуктовим директором Джеком Броді. Speech створює озвучений аудіо, налаштований під оригінальну фонову музику, і вбудований безпосередньо в Suno: користувачі вводять ідею, вірш або будь‑який написаний текст, а потім описують голос і музичний стиль, який вони уявляють.

У примітці про випуск від 1 жовтня 2026 року Speech описується як перша модель, що створює мову та її саундтрек разом в одному записі, і позначає запис для Android, iOS, веб‑версії та Create. Прикладами того, що користувачі можуть створювати, є казки на ніч під м’яке фортепіано, енергійні промови під ареністські барабани та ASMR‑списки покупок, і зазначається, що Speech доступний на мобільних пристроях та в веб‑версії.

Suno позиціонує запуск навколо того, що вона називає креативною розвагою, категорією, яку, за словами компанії, визначатиме наступна хвиля споживчих технологій. Музика залишається в центрі того, що створює Suno, написав Броді, тоді як бачення компанії поширюється на інші форми людського вираження. У дописі Speech описується як ще одне полотно для особистих творінь, які вже створює її спільнота, посилаючись на пісні, які користувачі створюють для днів народжень, весіль, внутрішніх жартів, віри та поклоніння, для своїх дітей і друзів.

Початкові використання та заявлені обмеження бети

За даними допису, команда Suno неофіційно експериментувала з моделлю під час розробки, перетворюючи текстові повідомлення друзів у драматичні читання, надаючи звичайним голосовим нотаткам епічні аранжування, а також створюючи медитації, вірші, підбадьорливі промови та казки на ніч для їхніх дітей.

Suno застерегла, що бета поводиться як справжня бета. Британський акцент іноді може переходити в австралійський і назад, написала компанія, і «драматичні паузи можуть бути дуже драматичними». Suno зазначила, що користувачі майже напевно виявлять застосування, про які команда не думала, додаючи, що саме таке відкриття є метою відкриття бети.

V6 та попередні випуски 2026 року

Speech слідує за серією випусків Suno, задокументованих у 2026 році. 9 вересня 2026 року компанія представила v6, нове покоління музичних моделей, розроблених спільно з галузевими партнерами Warner Music Group, BMG і Believe. Suno назвала моделі v6 своїми найкращими на сьогодні, описуючи їх як швидші, більш виразні та вищої якості. Сімейство v6 складається з трьох моделей: флагманської v6 і орієнтованої на дослідження v6-wild, обидві доступні підписникам Pro і Premier, а також v6-mini — швидша та більш ефективна версія, доступна всім.

Suno заявила, що v6 дозволяє творцям редагувати частину існуючої пісні за допомогою простих команд, створювати мікс із кількох джерел в одному запиті, семплювати та ізолювати аудіо для створення нового біту в одному робочому процесі, генерувати музику з тексту, аудіо, зображень та відео, а також оновлювати один рядок тексту без переробки всієї пісні. Приклад, який навела компанія: зміна приспіву так, щоб його виконував госпел‑хор.

Suno повідомила, що її команда проводить щотижневі творчі табори з художниками, продюсерами, авторами пісень та музикантами, щоб дізнатися, як вони використовують Suno у своїх творчих процесах, і що вона впровадила захисні механізми для перевірки завантажених аудіофайлів і текстів на несанкціоноване використання. Під час розгортання v6 компанія заявила, що планує відмовитися від попередніх моделей і перенести платформу повністю на покоління v6. У тому ж оголошенні Suno повідомила, що розробляє досвід за принципом opt‑in, орієнтований навколо окремих артистів, у якому артисти можуть обирати участь і отримувати оплату за свою участь.

Раніше в примітках про випуск Suno задокументовано інші продукти компанії 2026 року. Suno запустила v5.5 26 березня 2026 року, забезпечивши три функції: Voices, яка дозволяє користувачам записувати або завантажувати власний аудіо та співати у своїх творах; Custom Models, яка навчає персоналізовану версію v5.5 на щонайменше шести треках з каталогу користувача; та My Taste, яка з часом вивчає улюблені жанри, настрої та референси користувача. Voices стала доступною на iOS та Android 7 серпня 2026 року, дозволяючи користувачам один раз записати голос і використовувати його в будь‑якій пісні.

Suno випустила Studio 2.0, повне оновлення своєї браузерної генеративної аудіо‑станції з редагуванням MIDI, аудіо‑ефектами, вбудованими синтезаторами та чат‑панеллю, для підписників Premier 13 серпня 2026 року. Подальші оновлення Studio 17 вересня 2026 року зробили транскрипцію MIDI в аудіо швидшою та точнішою щодо оригінального матеріалу.

Suno заявила, що продовжуватиме вдосконалювати Speech, вивчаючи, що людям подобається, що ще не зовсім працює, і що спільнота хоче робити далі. У примітці про випуск користувачі просяться залишати відгуки, оскільки функція покращується з часом.

Luca Ren — аналітик, створений за допомогою ШІ, у Unite.AI, який охоплює штучний інтелект у розвагах, медіа та цифровому розповіданні історій. Його робота досліджує, як системи ШІ підбирають контент, впливають на виробництво фільмів, телебачення, музики та ігор, а також персоналізують медіа‑досвід для глобальної аудиторії.

Маючи креативний та орієнтований на тенденції підхід, Лука аналізує, як рекомендаційні системи, генеративні інструменти та аналітика аудиторії переосмислюють творчі робочі процеси та моделі розповсюдження. Особливо його цікавить, як ШІ впливає на структуру наративу, автономність творців та баланс між оптимізацією, заснованою на даних, і художнім виразом у сучасних медіа‑екосистемах.

Статті, написані Лукою Реном, створені за допомогою ШІ та перевірені редакційною командою Unite.AI, щоб забезпечити точність, культурний контекст та відповідальне висвітлення еволюції ролі ШІ у розвагах і медіа.