AIモデルとプラットフォーム

GoogleがLyria 3.5音楽生成をGeminiアプリとAPIで提供開始

mm
Unite.AI を Google の優先ソースに追加

Googleは2026年9月4日、音楽生成モデルであるLyria 3.5をGeminiアプリとGemini APIで利用できるようにし、今年初めにデビューしたGoogle Flow Musicツールを超えてモデルを拡張したと発表しました。同社はThe Keywordでの発表で、同モデルがウェブとモバイルアプリの全世界のGeminiユーザーに提供されると述べました。

GoogleはLyria 3.5を、これまでで最も音質の良い音楽生成モデルと位置付け、従来バージョンよりも表現力豊かなボーカルとよりリッチな楽曲アレンジを実現し、より高忠実度のトラックを生成すると述べています。このモデルは2026年7月29日にGoogle Flow Musicで初めてリリースされ、音楽性、歌詞、ボーカル品質のすべてで改善が行われたとGoogleは発表しました。

Geminiアプリの新しい作成コントロール

Geminiアプリ版のLyria 3.5は、一連のガイド付き作成機能を追加しました。ユーザーはジャンルを選択または記述し、ボーカルまたはインストゥルメンタルのスタイルを選べます。新しいテンプレートは、バックグラウンドミュージックからカスタム誕生日トラックまで幅広いプロジェクトの開始を想定して設計されており、短いトラックと長いトラックのどちらかを選択できるようになりました。

Googleはこの機能が、動画用のカスタムバックトラック、ブランドジングル、パーソナライズされた着信音などのユースケースを対象としていると述べました。アプリ以外でも、Lyria 3.5はGoogle Flow MusicでアーティストやAIクリエイティブに、またGoogle AI StudioとGoogle Vidsを通じて開発者や技術者に提供されています。

Google DeepMindのLyriaファミリーのモデルページでは、モデルが最大3分までの可変曲長に対応し、60秒のクリップからフルの3分楽曲まで、要求された長さに合わせた一貫したトラックを生成できると説明しています。ページでは、ユーザーが自分で歌詞を書いたり、特定のテーマやトピックに基づいて生成したりでき、ボーカルスタイルや音響の好みを設定できると述べられています。また、画像で作曲する機能も紹介されており、ユーザーは画像をアップロードすると、モデルがそれをトラックに変換します。

Gemini APIによる開発者向けアクセス

Googleの音楽生成に関する開発者向けドキュメント(2026年9月4日更新)によると、Lyria 3.5はテキストプロンプトまたは画像から44.1 kHzステレオ音声を生成し、ボーカル、タイミングされた歌詞、フルインストゥルメンタルアレンジを含む構造的な一貫性を保ちます。ドキュメントでは2つのモデルが掲載されています。モデルIDがlyria-3-clip-previewのLyria 3 Clipは、常に30秒のクリップをループやプレビュー用に生成し、モデルIDがlyria-3.5のLyria 3.5は、数分間続くヴァース、コーラス、ブリッジを含むフルレングスの楽曲を生成します。

両モデルはGoogleのInteractions APIを通じてアクセスでき、デフォルトでMP3音声を出力します。Lyria 3.5ではWAV出力も利用可能です。ドキュメントによれば、開発者はテキストプロンプトに加えて最大10枚の画像を提供でき、モデルは視覚コンテンツにインスパイアされた音楽を作曲します。また、Verse、Chorus、Bridgeといったセクションタグを用いてカスタム歌詞を提供したり、タイムスタンプで楽曲内の特定の瞬間(例:楽器が入るタイミング)を指定したりできます。指定した言語でプロンプトを行うと、その言語の歌詞が生成され、モデルはボーカルスタイルと発音を言語に合わせて調整するとドキュメントは述べています。音声が生成される前に、モデルはプロンプトに基づいて楽曲構造を推論します。

明示された制限事項とウォーターマーキング

開発者向けドキュメントにはいくつかの制限が列挙されています。すべてのプロンプトは安全フィルタを通過し、特定のアーティストの声や著作権で保護された歌詞の生成要求はブロックされます。音楽生成は単一ターンのプロセスであるため、複数のプロンプトにわたる生成クリップの反復的編集は現在のバージョンではサポートされていません。同一プロンプトでも呼び出しごとに結果が変わる可能性があります。

生成されたすべての音声には識別用のSynthIDウォーターマークが付与されており、Googleはこれを人間の耳には知覚できないと説明しています。DeepMindのモデルページでは、すべてのトラックがSynthIDで目に見えない形でウォーターマークされているため、リスナーやプラットフォームは音楽がAIで作成または編集されたかどうかを検出できると述べられています。また、Googleはトレーニングデータセットにおける有害コンテンツや有害な歌詞の可能性を減らすために、広範なフィルタリングとデータラベリングを実施していると記載されています。ページは、Googleが主要機能の改善に取り組んでおり、生成されたトラックが自分のビジョンに合致しているか確認するようユーザーに助言していることも付け加えています。

DeepMindのページは、Lyriaシリーズがプロデューサーやミュージシャンの意見を取り入れて開発されたこと、そして過去のアーティスト実験として、プロデューサーWyclef JeanのMusic AI Sandboxでの取り組みや、Yung Spielburgがアニメ短編Dear Upstairs NeighborsのスコアリングにLyriaを使用した例を挙げています。Lyria 3.5は2026年9月4日現在、Geminiアプリ、Google Flow Music、Google AI Studio、Google Vidsを通じて利用可能です。

Luca Ren は、Unite.AI の AI 生成アナリストで、エンターテイメント、メディア、デジタルストーリーテリングにおける人工知能を担当しています。
彼の仕事は、AI システムがコンテンツをキュレートし、映画、テレビ、音楽、ゲーム制作に影響を与え、世界の視聴者向けにメディア体験をパーソナライズする方法を探ります。

創造的かつトレンドに敏感な視点で、Luca はレコメンデーションエンジン、生成ツール、オーディエンス分析がクリエイティブなワークフローと配信モデルをどのように再構築しているかを検証します。
特に、AI が物語構造、クリエイターの自律性、そしてデータ駆動型最適化と芸術的表現のバランスにどのように影響するかに関心を持っています。

Luca Ren が執筆した記事は AI 生成であり、Unite.AI の編集チームがレビューして正確性、文化的文脈、エンターテイメントとメディアにおける AI の進化する役割に関する責任ある報道を保証しています。