AI 모델 및 플랫폼

Google, Gemini 앱 및 API에 Lyria 3.5 음악 생성 기능 제공

mm
Unite.AI를 Google의 선호 소스에 추가

Google은 2026년 9월 4일, 음악 생성 모델인 Lyria 3.5를 Gemini 앱 및 Gemini API에서 사용할 수 있도록 하여, 올해 초 처음 선보인 Google Flow Music 도구를 넘어 모델을 확장했습니다. 이 모델은 모든 Gemini 사용자가 웹과 모바일 앱에서 전 세계적으로 이용할 수 있다고 회사는 The Keyword에 대한 발표에서 밝혔습니다.

Google은 Lyria 3.5를 가장 음질이 뛰어난 음악 생성 모델이라고 설명하며, 이전 버전보다 더 표현력 있는 보컬과 풍부한 음악 편곡을 제공해 고음질 트랙을 생성한다고 밝혔습니다. 이 모델은 2026년 7월 29일 Google Flow Music에서 처음 출시되었으며, 그때 Google은 음악성, 가사 및 보컬 품질 전반에 걸친 개선을 제공한다고 발표했습니다.

Gemini 앱의 새로운 제작 제어 기능

Gemini 앱 버전의 Lyria 3.5는 일련의 가이드형 제작 기능을 추가했습니다. 사용자는 장르를 선택하거나 설명하고 보컬 또는 악기 스타일 중 하나를 선택할 수 있습니다. 새로운 템플릿은 배경 음악부터 맞춤형 생일 트랙까지 다양한 프로젝트를 시작하도록 설계되었으며, 이제 짧은 트랙과 긴 트랙 중에서 선택할 수 있습니다.

Google은 이 기능이 비디오용 맞춤 백킹 트랙, 브랜드 징글, 개인화된 벨소리와 같은 사용 사례를 목표로 한다고 밝혔습니다. 앱을 넘어 Lyria 3.5는 Google Flow Music에서 아티스트와 AI 크리에이티브가 사용할 수 있으며, 개발자와 기술자를 위해 Google AI Studio와 Google Vids에서도 제공됩니다.

Google DeepMind의 Lyria 제품군 모델 페이지는 이 모델이 최대 3분까지 가변적인 곡 길이를 지원하며, 60초 클립부터 전체 3분 곡까지 요청된 길이에 맞는 일관된 트랙을 생성할 수 있다고 설명합니다. 페이지에 따르면 사용자는 직접 가사를 작성하거나 특정 주제나 테마에 맞춰 생성할 수 있으며, 보컬 스타일과 음향 선호도를 정의할 수 있습니다. 또한 이미지를 활용한 작곡을 설명하는데, 사용자가 이미지를 업로드하면 모델이 이를 트랙으로 변환합니다.

Gemini API를 통한 개발자 접근

Google의 음악 생성용 개발자 문서(2026년 9월 4일 업데이트)에 따르면, Lyria 3.5는 텍스트 프롬프트 또는 이미지에서 44.1kHz 스테레오 오디오를 생성하며, 보컬, 타이밍이 맞춰진 가사 및 전체 악기 편곡을 포함하는 구조적 일관성을 제공합니다. 문서에는 두 가지 모델이 나열되어 있습니다: 모델 ID가 lyria-3-clip-preview인 Lyria 3 Clip은 루프와 미리보기를 위해 항상 30초 클립을 생성하고, 모델 ID가 lyria-3.5인 Lyria 3.5는 몇 분 길이의 구절, 코러스, 브릿지를 포함한 전체 곡을 생성합니다.

두 모델 모두 Google의 Interactions API를 통해 접근 가능하며 기본적으로 MP3 오디오를 출력하고, Lyria 3.5의 경우 WAV 출력도 지원합니다. 문서에 따르면 개발자는 텍스트 프롬프트와 함께 최대 10장의 이미지를 제공할 수 있으며, 모델은 시각적 콘텐츠에 영감을 받아 음악을 작곡합니다. 또한 Verse, Chorus, Bridge와 같은 섹션 태그를 사용해 맞춤 가사를 제공하고, 타임스탬프를 이용해 악기가 들어가는 시점 등 곡의 특정 순간을 지정할 수 있습니다. 지정된 언어로 프롬프트하면 해당 언어의 가사가 생성되며, 모델은 보컬 스타일과 발음을 해당 언어에 맞게 조정한다고 문서에 명시되어 있습니다. 오디오가 생성되기 전에 모델은 프롬프트를 기반으로 음악 구조를 논리적으로 판단합니다.

명시된 제한 사항 및 워터마킹

개발자 문서에는 몇 가지 제한 사항이 명시되어 있습니다. 모든 프롬프트는 안전 필터를 통과하며, 특정 아티스트의 목소리 요청이나 저작권이 있는 가사 생성은 차단됩니다. 음악 생성은 단일 단계 프로세스이므로 현재 버전에서는 여러 프롬프트에 걸친 생성된 클립의 반복 편집을 지원하지 않습니다. 동일한 프롬프트를 사용하더라도 호출마다 결과가 달라질 수 있습니다.

생성된 모든 오디오는 식별을 위한 SynthID 워터마크를 포함하고 있으며, Google은 이를 인간의 귀에 감지되지 않을 정도라고 설명합니다. DeepMind의 모델 페이지는 모든 트랙에 SynthID 워터마크가 눈에 띄지 않게 적용되어 청취자와 플랫폼이 음악이 AI를 사용해 생성되었는지 편집되었는지 확인할 수 있다고 밝히며, Google은 훈련 데이터셋의 유해 콘텐츠와 유해 가사 발생 가능성을 줄이기 위해 광범위한 필터링과 데이터 라벨링을 사용한다고 합니다. 페이지는 또한 Google이 핵심 역량을 지속적으로 개선하고 있으며, 사용자는 생성된 트랙이 자신의 비전에 맞는지 확인할 것을 권고합니다.

DeepMind 페이지는 또한 Lyria 라인이 프로듀서와 뮤지션의 의견을 반영해 개발되었으며, 이전 아티스트들의 Google 음악 도구 실험 사례를 나열합니다. 여기에는 프로듀서 Wyclef Jean이 Music AI Sandbox와 함께 진행한 작업과 Yung Spielburg가 애니메이션 단편 Dear Upstairs Neighbors의 음악을 제작하기 위해 Lyria를 활용한 사례가 포함됩니다. Lyria 3.5는 2026년 9월 4일 현재 Gemini 앱, Google Flow Music, Google AI Studio 및 Google Vids를 통해 이용할 수 있습니다.

Luca Ren은(는) Unite.AI에서 AI 생성 분석가로서 엔터테인먼트, 미디어 및 디지털 스토리텔링 분야의 인공지능을 다룹니다. 그의 작업은 AI 시스템이 콘텐츠를 큐레이션하고, 영화, 텔레비전, 음악 및 게임 제작에 영향을 미치며, 전 세계 관객을 위한 미디어 경험을 개인화하는 방식을 탐구합니다.

창의적이고 트렌드에 민감한 관점으로, Luca는 추천 엔진, 생성 도구 및 시청자 분석이 창작 워크플로와 배포 모델을 어떻게 재구성하고 있는지 검토합니다. 그는 특히 AI가 서사 구조, 창작자 자율성, 그리고 데이터 기반 최적화와 예술적 표현 사이의 균형에 미치는 영향을 관심 있게 살펴봅니다.

Luca Ren이 작성한 기사들은 AI가 생성하고 Unite.AI 편집팀이 검토하여 정확성, 문화적 맥락 및 엔터테인먼트와 미디어 분야에서 AI의 진화하는 역할에 대한 책임 있는 보도를 보장합니다.