Lyria 3와 Gemini 음악 생성
Lyria 3 기능 및 특징
Lyria 3는 Google DeepMind가 만든 최신 생성 음악 모델로, 사용자 프롬프트를 따라 캐치하고 고품질의 트랙으로 변환하도록 설계되었습니다. 기존 Lyria 모델에 비해 세 가지 주요 영역에서 개선되었습니다: 프롬프트 기반 자동 가사 생성, 템포·보컬·스타일에 대한 창의적 제어 강화, 그리고 보다 현실적이고 음악적으로 복잡한 트랙 제작.
- Text-to-Track: 사용자는 특정 분위기, 장르, 혹은 기억을 설명하여 악기만의 오디오 또는 가사가 포함된 트랙을 만들 수 있습니다. 예를 들어, 사용자는 특정 개인 기억을 바탕으로 “재미있는 아프로비트 트랙”을 요청할 수 있습니다.
- Image and Video-to-Track: 사용자는 사진이나 비디오를 업로드하면 Gemini가 시각 콘텐츠의 분위기에 맞는 가사가 포함된 트랙을 작곡합니다.
각 생성된 트랙은 30초 길이이며 Nano Banana가 만든 맞춤형 커버 아트를 포함합니다.
YouTube Dream Track와의 통합
Lyria 3는 YouTube의 Dream Track에도 통합되고 있습니다. 처음에는 미국에서만 제공되었으며 현재는 다른 국가의 크리에이터에게도 확대되고 있습니다. 이 모델은 YouTube Shorts의 사운드트랙 품질을 향상시켜 크리에이터가 보다 맞춤화된 가사 구절이나 배경 트랙을 생성할 수 있게 합니다.
오디오 검증 및 SynthID
AI 생성 콘텐츠의 식별을 보장하기 위해 Gemini 앱에서 제작된 모든 트랙에는 눈에 보이지 않는 워터마크인 SynthID가 삽입됩니다. Google은 Gemini 앱 내 검증 도구를 오디오까지 확장했습니다. 사용자는 오디오 파일을 업로드하고 Gemini에 해당 파일이 Google AI에 의해 생성되었는지 물어볼 수 있으며, 모델은 해당ID 워터마크를 확인하고 자체 추론을 통해 답변을 제공합니다.
책임 있는 AI 개발 및 저작권
Google DeepMind는 Lyria 3가 기존 아티스트를 모방하기보다 독창적인 표현을 위해 설계되었다고 밝혔습니다. 사용자가 특정 아티스트 이름을 프롬프트에 입력하면 Gemini는 이를 직접적인 모방이 아닌 스타일이나 분위기에 대한 폭넓은 창의적 영감으로 처리합니다.
지적 재산권을 보호하기 위해 Google은 출력물을 기존 콘텐츠와 비교하는 필터를 구현했습니다. 사용자는 Google의 서비스 약관 및 Gen AI 금지 사용 정책을 준수해야 하며, 이는 지적 재산권 및 프라이버시 권리 침해를 금지합니다. 권리를 침해할 수 있는 콘텐츠에 대해 신고할 수 있는 메커니즘도 제공됩니다.
이용 가능성 및 접근성
Lyria 3는 영어, 독일어, 스페인어, 프랑스어, 힌디어, 일본어, 한국어, 포르투갈어를 지원하며, 18세 이상 사용자에게 Gemini 앱에서 제공됩니다. 이 기능은 오늘 데스크톱에 롤아웃되었으며 향후 며칠 내에 모바일 앱에도 적용될 예정입니다. Google AI Plus, Pro, Ultra 구독자는 더 높은 사용 한도를 가집니다.