Modele i platformy AI
Suno wprowadza wersję beta Speech, łącząc głos i muzykę w jednym modelu

Suno ogłosił Speech (beta) 1 października 2026 roku, wypuszczając model dźwięku mówionego, który firma opisuje jako pierwszy generujący jednocześnie głos i muzykę jako jedną spójną ścieżkę. Wersja beta została udostępniona wszystkim użytkownikom na urządzeniach mobilnych i w przeglądarce po miesiącu testów z małą grupą.
Ogłoszenie pojawiło się w wpisie na blogu firmowym napisanym przez dyrektora ds. produktu Jacka Brody’ego. Speech tworzy nagranie mówione z oryginalną muzyką w tle i jest wbudowane bezpośrednio w Suno: użytkownicy wpisują pomysł, wiersz lub własny tekst, a następnie opisują pożądaną głos i styl muzyczny.
nota wydania z dnia 1 października 2026 opisuje Speech jako pierwszy model, który tworzy mowę i jej ścieżkę dźwiękową razem w jednym ujęciu, i oznacza wpis jako przeznaczony na Android, iOS, web i Create. Przykłady tego, co użytkownicy mogą tworzyć, obejmują bajki na dobranoc przy delikatnym pianinie, przemowy motywacyjne przy stadionowych bębnach oraz listy zakupów w stylu ASMR, a także stwierdza, że Speech jest dostępny na urządzeniach mobilnych i w sieci.
Suno prezentuje premierę jako część tego, co nazywa kreatywną rozrywką, kategorią, o której firma twierdzi, że zdefiniuje następną falę technologii konsumenckich. Muzyka pozostaje sercem tego, co Suno tworzy, napisał Brody, podczas gdy wizja firmy sięga także innych form ludzkiej ekspresji. Wpis opisuje Speech jako kolejny płótno dla osobistych dzieł, które już tworzy społeczność, wskazując na piosenki tworzone przez użytkowników na urodziny, wesela, wewnętrzne żarty, wiarę i kult, dla ich dzieci i przyjaciół.
Wczesne zastosowania i wymienione ograniczenia wersji beta
Według wpisu zespół Suno eksperymentował z modelem nieformalnie podczas opracowywania, przekształcając wiadomości tekstowe znajomych w dramatyczne odczyty, nadając zwykłym notatkom głosowym epickie podkłady oraz tworząc medytacje, wiersze, motywacyjne przemowy i opowieści na dobranoc dla ich dzieci.
Suno ostrzegło, że beta zachowuje się w praktyce jak beta. Brytyjski akcent może czasami przeskoczyć w australijski i z powrotem, napisała firma, a „dramatyczne pauzy mogą być bardzo dramatyczne”. Suno stwierdziło, że użytkownicy z pewnością odkryją zastosowania, o których zespół nie pomyślał, dodając, że tego rodzaju odkrycia są celem udostępnienia wersji beta.
Wydania V6 i wcześniejsze w 2026 roku
Speech następuje po serii wydań Suno udokumentowanych w 2026 roku. 9 września 2026 firma wprowadził v6, nową generację modeli muzycznych opracowaną we współpracy z partnerami branżowymi Warner Music Group, BMG i Believe. Suno określiło modele v6 jako najlepsze dotąd, opisując je jako szybsze, bardziej ekspresyjne i wyższej jakości. Rodzina v6 składa się z trzech modeli: flagowego v6 i eksploracyjnego v6-wild, dostępnych dla subskrybentów Pro i Premier, oraz v6-mini, szybszej i bardziej wydajnej wersji dostępnej dla wszystkich.
Suno powiedziało, że v6 pozwala twórcom edytować część istniejącej piosenki przy użyciu prostego języka, tworzyć mashup z wielu źródeł w jednym żądaniu, próbować i izolować dźwięk w celu stworzenia nowego rytmu w jednym procesie, tworzyć muzykę z tekstu, dźwięku, obrazów i wideo oraz aktualizować pojedynczy wers bez konieczności przebudowy całej piosenki. Jeden przykład podany przez firmę: zmiana refrenu, aby został zaśpiewany przez chór gospel.
Suno poinformowało, że jego zespół organizuje cotygodniowe obozy pisarskie z artystami, producentami, autorami tekstów i muzykami, aby dowiedzieć się, jak używają Suno w swoich kreatywnych procesach, oraz że wprowadziło zabezpieczenia mające na celu przeglądanie przesyłanych plików audio i tekstów pod kątem nieautoryzowanego użycia. W miarę wprowadzania v6 firma zapowiedziała, że planuje wycofać poprzednie modele i przenieść platformę całkowicie na generację v6. W tym samym ogłoszeniu Suno poinformowało, że opracowuje doświadczenia typu opt‑in oparte na poszczególnych artystach, w których artyści mogą wybrać udział i otrzymać wynagrodzenie za to.
Wcześniejsze wpisy w notatkach wydawniczych Suno dokumentują resztę linii produktów firmy w 2026 roku. Suno wprowadziło v5.5 26 marca 2026, napędzając trzy funkcje: Voices, która pozwala użytkownikom nagrywać lub przesyłać własny dźwięk i śpiewać w swoich dziełach; Custom Models, które uczą spersonalizowaną wersję v5.5 na co najmniej sześciu utworach z katalogu użytkownika; oraz My Taste, która z czasem uczy się ulubionych gatunków, nastrojów i odniesień użytkownika. Voices trafiło na iOS i Android 7 sierpnia 2026, umożliwiając użytkownikom jednorazowe nagranie głosu i użycie go w dowolnej piosence.
Suno wypuściło Studio 2.0, gruntowną modernizację swojego przeglądarkowego generatywnego warsztatu audio z edycją MIDI, efektami dźwiękowymi, wbudowanymi syntezatorami i paskiem czatu, dla subskrybentów Premier, 13 sierpnia 2026 roku. Kolejne aktualizacje Studio z 17 września 2026 przyspieszyły i zwiększyły dokładność transkrypcji MIDI‑na‑audio w stosunku do oryginalnego materiału.
Suno poinformowało, że będzie nadal udoskonalać Speech, ucząc się, co ludzie kochają, co jeszcze nie działa w pełni oraz co społeczność chce zrobić dalej. Notatka o wydaniu prosi użytkowników o opinie, gdy funkcja będzie się z czasem ulepszać.












