Lyria 3 を使用した Gemini の音楽生成
Google DeepMind は Lyria 3 生成音楽モデルを Gemini アプリに統合し、ユーザーがテキストまたは画像を使用して 30 秒の AI 生成トラックを作成できるようにしました。このアップデートにより、Gemini のクリエイティブツールセットは画像や動画を超えて、高品質でカスタマイズ可能なオーディオ生成を含むようになりました。
Lyria 3 の機能と特徴
Lyria 3 は Google DeepMind が提供する最新の生成音楽モデルで、ユーザーのプロンプトをキャッチーで高品質なトラックに変換するよう設計されています。従来の Lyria モデルに比べ、主に次の 3 つの領域で改善されています:プロンプトに基づく歌詞の自動生成、テンポ・ボーカル・スタイルに対する創造的コントロールの向上、そしてよりリアルで音楽的に複雑なトラックの生成です。
ユーザーは主に 2 つの入力方法で音楽を生成できます:
- Text-to-Track: ユーザーは特定のムード、ジャンル、思い出を記述して、インストゥルメンタル音声や歌詞付きトラックを作成できます。たとえば、ユーザーは「楽しいアフロビートトラック」を個人的な思い出に基づいてリクエストできます。
- Image and Video-to-Track: ユーザーは写真や動画をアップロードし、Gemini がビジュアルコンテンツのムードに合った歌詞付きトラックを作曲します。
各生成トラックは 30 秒の長さで、Nano Banana が作成したカスタムカバーアートが含まれます。
YouTube Dream Track との統合
Lyria 3 は YouTube の Dream Track にも統合されています。当初は米国で利用可能でしたが、現在は他国のクリエイターにも拡大中です。このモデルは YouTube Shorts のサウンドトラック品質を向上させ、クリエイターがよりカスタマイズされた歌詞のバースやバックトラックを生成できるようにします。
オーディオ検証と SynthID
AI 生成コンテンツの識別を確実にするため、Gemini アプリで生成されたすべてのトラックには目に見えない透かしである SynthID が埋め込まれています。Google は Gemini アプリ内の検証ツールを音声対応に拡張しました。ユーザーは音声ファイルをアップロードし、Gemini に「Google AI が生成したか」を尋ねることができ、モデルは SynthID の透かしをチェックし、独自の推論で回答を提供します。
責任ある AI 開発と著作権
Google DeepMind は、Lyria 3 が既存アーティストの模倣ではなくオリジナル表現を目的として設計されていると述べています。ユーザーが特定のアーティスト名でプロンプトを入力した場合、Gemini はそれをスタイルやムードの広範な創作インスピレーションとして扱い、直接的な模倣とはみなしません。
知的財産を保護するため、Google は出力を既存コンテンツと照合するフィルタを実装しています。ユーザーは Google の利用規約および Gen AI 禁止使用ポリシーに従う必要があり、これらは知的財産権やプライバシー権の侵害を禁じています。また、権利侵害の可能性があるコンテンツを報告するメカニズムも用意されています。
利用可能性とアクセス
Lyria 3 は Gemini アプリで、18 歳以上のユーザー向けに英語、ドイツ語、スペイン語、フランス語、ヒンディー語、日本語、韓国語、ポルトガル語で利用可能です。この機能は本日デスクトップでロールアウトが開始され、数日以内にモバイルアプリにも展開されます。Google AI Plus、Pro、Ultra のサブスクリプションを持つユーザーは、使用上限が高く設定されています。