Model dan platform AI
Suno Meluncurkan Speech Beta, Menggabungkan Suara dan Musik dalam Satu Model

Suno mengumumkan Speech (beta) pada 1 Oktober 2026, merilis model audio berbicara yang perusahaan gambarkan sebagai yang pertama menghasilkan suara dan musik bersama dalam satu trek yang kohesif. Beta tersebut dibuka untuk semua pengguna di seluler dan web setelah sebulan pengujian dengan kelompok kecil.
Pengumuman tersebut muncul dalam posting blog perusahaan yang ditulis oleh Chief Product Officer Jack Brody. Speech menciptakan audio berbicara yang disertai musik latar asli dan dibangun langsung ke dalam Suno: pengguna mengetik ide, puisi, atau sesuatu yang telah mereka tulis, lalu menggambarkan suara dan gaya musik yang mereka inginkan.
Sebuah catatan rilis bertanggal 1 Oktober 2026, menjelaskan Speech sebagai model pertama yang menciptakan pidato dan soundtrack-nya bersama dalam satu pengambilan, dan menandai entri untuk Android, iOS, web, dan Create. Contoh apa yang dapat dibuat pengguna meliputi cerita pengantar tidur dengan piano lembut, pidato semangat dengan drum stadion, dan daftar belanja ASMR, serta menyatakan bahwa Speech tersedia di seluler dan web.
Suno membingkai peluncuran ini di sekitar apa yang disebutnya hiburan kreatif, sebuah kategori yang perusahaan katakan akan mendefinisikan gelombang berikutnya dari teknologi konsumen. Musik tetap menjadi inti dari apa yang dibangun Suno, tulis Brody, sementara visi perusahaan meluas ke bentuk ekspresi manusia lainnya. Posting tersebut menggambarkan Speech sebagai kanvas lain untuk kreasi pribadi yang sudah dibuat komunitasnya, menunjukkan lagu-lagu yang diproduksi pengguna untuk ulang tahun, pernikahan, lelucon dalam, kepercayaan dan ibadah, anak-anak mereka, dan teman-teman mereka.
Penggunaan Awal dan Batasan Beta yang Dinyatakan
Menurut posting tersebut, tim Suno bereksperimen dengan model ini secara informal selama pengembangan, mengubah pesan teks teman menjadi pembacaan dramatis, memberi catatan suara biasa skor epik, serta membuat meditasi, puisi, ceramah motivasi, dan cerita pengantar tidur untuk anak-anak mereka.
Suno memperingatkan bahwa beta berperilaku seperti beta dalam praktiknya. Aksen Inggris kadang-kadang dapat beralih menjadi aksen Australia dan kembali, tulis perusahaan, dan “jeda dramatis mungkin sangat dramatis.” Suno mengatakan pengguna hampir pasti akan menemukan penggunaan yang tidak pernah terpikirkan oleh tim, menambahkan bahwa jenis penemuan ini adalah tujuan dibukanya beta.
Rilis V6 dan Sebelumnya 2026
Speech mengikuti serangkaian rilis Suno yang didokumentasikan pada 2026. Pada 9 September 2026, perusahaan memperkenalkan v6, generasi baru model musik yang dikembangkan bersama mitra industri Warner Music Group, BMG dan Believe. Suno menyebut model v6 sebagai yang terbaik sejauh ini, menggambarkannya sebagai lebih cepat, lebih ekspresif, dan berkualitas tinggi. Keluarga v6 terdiri dari tiga model: v6 utama dan v6-wild yang berorientasi eksplorasi, keduanya tersedia untuk pelanggan Pro dan Premier, serta v6-mini, versi yang lebih cepat dan lebih efisien yang tersedia untuk semua orang.
Suno mengatakan v6 memungkinkan kreator mengedit bagian dari lagu yang ada menggunakan bahasa biasa, membuat mashup dari beberapa sumber dalam satu permintaan, mencontoh dan mengisolasi audio untuk membangun beat baru dalam satu alur kerja, menciptakan musik dari teks, audio, gambar, dan video, serta memperbarui satu lirik tanpa membangun ulang seluruh lagu. Salah satu contoh yang diberikan perusahaan: mengubah bagian refrain sehingga dinyanyikan oleh paduan suara gospel.
Suno mengatakan timnya mengadakan kamp menulis mingguan dengan artis, produser, penulis lagu, dan musisi untuk mempelajari bagaimana mereka menggunakan Suno dalam alur kerja kreatif mereka, dan bahwa mereka telah memperkenalkan langkah-langkah pengamanan untuk menyaring file audio dan lirik yang diunggah dari penggunaan tidak sah. Saat v6 diluncurkan, perusahaan menyatakan rencananya untuk menghentikan model sebelumnya dan memindahkan platform sepenuhnya ke generasi v6. Dalam pengumuman yang sama, Suno mengatakan sedang mengembangkan pengalaman opt-in yang dibangun di sekitar artis individual, di mana artis dapat memilih untuk berpartisipasi dan dibayar ketika mereka melakukannya.
Entri sebelumnya dalam catatan rilis Suno mendokumentasikan sisa lini produk perusahaan pada 2026. Suno meluncurkan v5.5 pada 26 Maret 2026, mendukung tiga fitur: Voices, yang memungkinkan pengguna merekam atau mengunggah audio mereka sendiri dan menyanyikan kreasi mereka; Custom Models, yang melatih versi personalisasi v5.5 pada setidaknya enam trek dari katalog pengguna; dan My Taste, yang mempelajari genre, suasana hati, dan referensi pilihan pengguna seiring waktu. Voices tersedia di iOS dan Android pada 7 Agustus 2026, memungkinkan pengguna merekam suara sekali dan menggunakannya pada lagu apa pun.
Suno merilis Studio 2.0, sebuah perombakan workstation audio generatif berbasis browser dengan penyuntingan MIDI, efek audio, synth bawaan, dan bilah obrolan, untuk pelanggan Premier pada 13 Agustus 2026. Pembaruan Studio lebih lanjut pada 17 September 2026, membuat transkripsi MIDI-ke-audio lebih cepat dan lebih akurat terhadap materi asli.
Suno mengatakan akan terus meningkatkan Speech seiring ia mempelajari apa yang disukai orang, apa yang belum berfungsi sepenuhnya, dan apa yang ingin dilakukan komunitas selanjutnya. Catatan rilis meminta umpan balik pengguna seiring fitur ini berkembang seiring waktu.












