AIモデルとプラットフォーム
Suno、音声と音楽を1つのモデルで組み合わせたSpeechベータを発表

Suno Speech(ベータ)を発表した 2026年10月1日、同社が声と音楽を同時に生成する初の統合トラックとして説明する音声オーディオモデルをリリースしました。ベータ版は、少人数で1か月間テストした後、モバイルとウェブのすべてのユーザーに公開されました。
この発表は、最高製品責任者Jack Brodyが執筆した会社のブログ投稿で行われました。Speechはオリジナルのバックグラウンド音楽に合わせた音声オーディオを生成し、Sunoに直接組み込まれています。ユーザーはアイデアや詩、または自分で書いたものを入力し、希望する声と音楽スタイルを説明します。
2026年10月1日付のリリースノートでは、Speechを1回の処理で音声とサウンドトラックを同時に作成する初のモデルとして説明し、エントリにAndroid、iOS、ウェブ、Createのタグを付けています。ユーザーが作成できる例として、柔らかなピアノの上に流れる寝物語、スタジアムのドラムに合わせたハイプスピーチ、ASMRの買い物リストなどが挙げられ、Speechはモバイルとウェブで利用可能であると記載されています。
Sunoはこの発売を「クリエイティブエンターテインメント」と呼ぶカテゴリーを中心に位置付けており、同社はこれが次世代のコンシューマーテクノロジーの波を定義すると考えています。Brodyは、Sunoが構築するものの中心に音楽があり、同社のビジョンは人間の表現の他の形態へと拡大すると述べました。この投稿は、Speechをコミュニティがすでに作り出している個人的な創作物のための別のキャンバスと説明し、ユーザーが誕生日、結婚式、内輪のジョーク、信仰と礼拝、子どもや友人のために制作する楽曲を例示しています。
初期の使用例とベータ版の制限事項
投稿によると、Sunoのチームは開発中に非公式にモデルを試し、友人のテキストメッセージをドラマチックな朗読に変換し、普通の音声メモに壮大なスコアを付け、子ども向けに瞑想、詩、励ましのスピーチ、寝物語を作成しました。
Sunoはベータ版が実際にベータとして機能すると警告しています。会社は、イギリス語アクセントが時折オーストラリア語アクセントに変わり、再び戻ることがあり、”ドラマティックな間隔は非常にドラマティックになることがある” と記載しています。Sunoは、ユーザーはほぼ確実にチームが想像しなかった使い方を発見するだろうと述べ、このような発見こそがベータ版を公開する目的であると付け加えました。
V6 とそれ以前の2026年リリース
Speechは、2026年に記録された一連のSunoリリースに続きます。2026年9月9日、同社はv6 を導入した、業界パートナーであるWarner Music Group, BMG and Believeと共同開発した新世代の音楽モデルです。Sunoはv6モデルをこれまでで最高と呼び、より高速で表現力が高く、品質も向上していると説明しました。v6ファミリーは3つのモデルで構成されます:フラッグシップモデルのv6と探索志向のv6-wildはProおよびPremierサブスクライバーが利用でき、v6-miniはより高速かつ効率的なバージョンで全ユーザーが利用可能です。
Sunoは、v6によりクリエイターが既存の曲の一部を自然言語で編集し、複数のソースから1回のリクエストでマッシュアップを作成し、オーディオをサンプリング・分離して単一のワークフローで新しいビートを構築し、テキスト、オーディオ、画像、動画から音楽を生成し、曲全体を再構築せずに歌詞の一部を更新できると述べました。会社が示した例として、コーラスをゴスペル合唱団が歌うように変更することが挙げられます。
Sunoは、チームがアーティスト、プロデューサー、ソングライター、ミュージシャンと週次のライティングキャンプを開催し、彼らがSunoを創作ワークフローでどのように活用しているかを学んでいると述べ、また、アップロードされたオーディオファイルや歌詞の無断使用を検出するための保護策を導入したと付け加えました。v6の展開に伴い、同社は従来のモデルを廃止し、プラットフォームを完全にv6世代へ移行する計画であると発表しました。同じ発表で、Sunoは個別アーティストを中心にしたオプトイン体験を開発中で、アーティストは参加を選択し、参加時に報酬を受け取ることができると述べました。
Suno のリリースノートの以前のエントリは、同社の2026年製品ラインの残りを記録しています。Sunoは2026年3月26日にv5.5を発売し、3つの機能を提供しました:Voicesはユーザーが自分の音声を録音またはアップロードし、作品に歌わせることができ、Custom Modelsはユーザーのカタログから少なくとも6曲を使用してv5.5のパーソナライズ版をトレーニングし、My Tasteは時間とともにユーザーの好むジャンル、ムード、参照を学習します。Voicesは2026年8月7日にiOSとAndroidに到達し、ユーザーは一度音声を録音すれば任意の曲で使用できるようになりました。
Sunoは2026年8月13日に、MIDI編集、オーディオエフェクト、内蔵シンセ、チャットバーを備えたブラウザベースの生成オーディオワークステーションの大幅な刷新であるStudio 2.0をPremierサブスクライバー向けにリリースしました。2026年9月17日のさらなるStudioアップデートにより、MIDIからオーディオへの転写がより高速かつ元素材に忠実になりました。
Sunoは、人々が好むもの、まだうまく機能しないもの、コミュニティが次に望むことを学びながら、Speechの改善を続けると述べました。リリースノートは、機能が時間とともに向上するにつれてユーザーにフィードバックを求めています。












