KI-Modelle und Plattformen
Suno startet Speech-Beta, kombiniert Stimme und Musik in einem Modell

Suno kündigte Speech (Beta) am 1. Oktober 2026 und stellte ein gesprochenes Audio‑Modell vor, das das Unternehmen als das erste bezeichnet, das Stimme und Musik gemeinsam als zusammenhängenden Track erzeugt. Die Beta wurde nach einem Monat Testen mit einer kleinen Gruppe allen Nutzern auf Mobilgeräten und im Web geöffnet.
Die Ankündigung erfolgte in einem Unternehmens‑Blogbeitrag, der vom Chief Product Officer Jack Brody verfasst wurde. Speech erzeugt gesprochene Audios, die zu originaler Hintergrundmusik gesetzt sind, und ist direkt in Suno integriert: Nutzer geben eine Idee, ein Gedicht oder einen selbst verfassten Text ein und beschreiben anschließend die gewünschte Stimme und den musikalischen Stil.
Eine Release-Notiz vom 1. Oktober 2026 beschreibt Speech als das erste Modell, das Sprache und deren Soundtrack in einem Durchlauf gemeinsam erstellt, und kennzeichnet den Eintrag für Android, iOS, Web und Create. Zu den Beispielen, die Nutzer erstellen könnten, gehören Gutenachtgeschichten mit sanftem Klavier, motivierende Reden mit Stadion‑Drums und ASMR‑Einkaufsliste, und es wird angegeben, dass Speech auf Mobilgeräten und im Web verfügbar ist.
Suno positioniert den Start rund um das, was das Unternehmen kreative Unterhaltung nennt, eine Kategorie, von der es glaubt, dass sie die nächste Welle der Konsumententechnologie prägen wird. Musik bleibt das Herzstück von Sunos Produkten, schrieb Brody, während die Vision des Unternehmens auf weitere Formen menschlichen Ausdrucks ausgedehnt wird. Der Beitrag beschreibt Speech als weitere Leinwand für die persönlichen Kreationen, die die Community bereits erstellt, und verweist auf Lieder, die Nutzer für Geburtstage, Hochzeiten, Insider‑Witze, Glauben und Anbetung, ihre Kinder und Freunde produzieren.
Frühe Anwendungsbeispiele und angegebene Beta‑Einschränkungen
Laut dem Beitrag experimentierte das Suno‑Team während der Entwicklung informell mit dem Modell, indem es Textnachrichten von Freunden in dramatische Lesungen verwandelte, gewöhnlichen Sprachnotizen epische Soundtracks verlieh und Meditationen, Gedichte, Motivationsansprachen sowie Gutenachtgeschichten für ihre Kinder erstellte.
Suno wies darauf hin, dass die Beta in der Praxis wie eine solche funktioniert. Ein britischer Akzent kann gelegentlich in einen australischen übergehen und wieder zurück, schrieb das Unternehmen, und „dramatische Pausen können sehr dramatisch sein.“ Suno sagte, die Nutzer werden mit hoher Wahrscheinlichkeit Anwendungsfälle entdecken, die dem Team nie eingefallen sind, und fügte hinzu, dass genau diese Art von Entdeckung der Grund dafür sei, die Beta zu öffnen.
V6 und frühere Veröffentlichungen 2026
Speech folgt einer Reihe von Suno‑Veröffentlichungen, die 2026 dokumentiert wurden. Am 9. September 2026 führte das Unternehmen v6 ein, eine neue Generation von Musikmodellen, die mit den Branchenpartnern Warner Music Group, BMG und Believe entwickelt wurden. Suno bezeichnete die v6‑Modelle als die bisher besten und beschrieb sie als schneller, ausdrucksstärker und von höherer Qualität. Die v6‑Familie besteht aus drei Modellen: dem Flaggschiff‑v6 und dem explorationsorientierten v6‑wild, beide für Pro‑ und Premier‑Abonnenten verfügbar, sowie v6‑mini, einer schnelleren und effizienteren Version, die allen zur Verfügung steht.
Suno erklärte, dass v6 Kreativen ermöglicht, einen Teil eines bestehenden Songs mit einfacher Sprache zu bearbeiten, aus mehreren Quellen in einer Anfrage ein Mashup zu erstellen, Audio zu sampeln und zu isolieren, um in einem einzigen Workflow einen neuen Beat zu bauen, Musik aus Text, Audio, Bildern und Video zu erzeugen und einen einzelnen Text zu ändern, ohne den gesamten Song neu zu erstellen. Ein Beispiel, das das Unternehmen nannte: einen Refrain so zu ändern, dass er von einem Gospelchor gesungen wird.
Suno sagte, sein Team veranstalte wöchentliche Schreibcamps mit Künstlern, Produzenten, Songwritern und Musikern, um zu erfahren, wie sie Suno in ihren kreativen Arbeitsabläufen nutzen, und habe Schutzmaßnahmen eingeführt, um hochgeladene Audiodateien und Texte auf unbefugte Nutzung zu prüfen. Während v6 ausgerollt wird, plant das Unternehmen, seine vorherigen Modelle einzustellen und die Plattform vollständig auf die v6‑Generation umzustellen. In derselben Ankündigung erklärte Suno, dass es opt‑in‑Erlebnisse entwickelt, die um einzelne Künstler herum aufgebaut sind, wobei Künstler wählen können, teilzunehmen und dafür bezahlt zu werden.
Frühere Einträge in Suno’s Release-Notizen dokumentieren den Rest der 2026‑Produktpalette des Unternehmens. Suno brachte am 26. März 2026 v5.5 heraus, das drei Funktionen bereitstellt: Voices, das Nutzern erlaubt, ihr eigenes Audio aufzunehmen oder hochzuladen und auf ihren Kreationen zu singen; Custom Models, das eine personalisierte Version von v5.5 anhand von mindestens sechs Titeln aus dem Katalog eines Nutzers trainiert; und My Taste, das im Laufe der Zeit die bevorzugten Genres, Stimmungen und Referenzen eines Nutzers erlernt. Voices wurde am 7. August 2026 für iOS und Android verfügbar, sodass Nutzer eine Stimme einmal aufnehmen und für jeden Song verwenden können.
Suno veröffentlichte am 13. August 2026 Studio 2.0, eine umfassende Überarbeitung seiner browserbasierten generativen Audio‑Workstation mit MIDI‑Bearbeitung, Audioeffekten, integrierten Synthesizern und einer Chat‑Leiste, für Premier‑Abonnenten. Weitere Studio‑Updates am 17. September 2026 machten die MIDI‑zu‑Audio‑Transkription schneller und genauer im Vergleich zum Originalmaterial.
Suno erklärte, dass es Speech weiter verbessern wird, während es lernt, was die Menschen lieben, was noch nicht ganz funktioniert und was die Community als Nächstes tun möchte. Die Release‑Notiz bittet die Nutzer um Feedback, während die Funktion im Laufe der Zeit verbessert wird.












