使用 Lyria 3 的 Gemini 音乐生成
Lyria 3 的能力与特性
Lyria 3 是 Google DeepMind 最新的生成音乐模型,旨在将用户提示转化为朗朗上口的高质量曲目。它在三个主要方面相较于之前的 Lyria 模型有所提升:基于提示的歌词自动生成、对节奏、声乐和风格的创意控制增强,以及生成更真实、音乐结构更复杂的曲目。
用户可以通过两种主要输入方式生成音乐:
- Text-to-Track(文本生成曲目): 用户可以描述特定的情绪、流派或记忆,以创建纯音乐或带歌词的曲目。例如,用户可以基于某段个人记忆请求一首“有趣的 Afrobeat 曲目”。
- Image and Video-to-Track(图像/视频生成曲目): 用户可以上传照片或视频,Gemini 将创作一段符合视觉内容情绪的带歌词曲目。
每段生成的曲目时长为 30 秒,并附有由 Nano Banana 创作的自定义封面艺术。
与 YouTube Dream Track 的集成
Lyria 3 也正在集成到 YouTube 的 Dream Track 中。最初在美国推出,现正向其他国家的创作者扩展,该模型提升了 YouTube Shorts 配乐的质量,使创作者能够生成更具定制化的歌词段落或伴奏。
音频验证与 SynthID
为确保 AI 生成内容的可识别性,Gemini 应用中生成的所有曲目都会嵌入 SynthID——一种不可感知的水印。Google 还在 Gemini 应用中扩展了验证工具,加入了音频验证。用户可以上传音频文件并询问 Gemini 是否由 Google AI 生成;模型将检查 SynthID 水印并结合自身推理给出答复。
负责任的 AI 开发与版权
Google DeepMind 表示,Lyria 3 的设计旨在实现原创表达,而非模仿现有艺术家。当用户以特定艺术家的名字进行提示时,Gemini 将此请求视为对风格或情绪的广泛创意灵感,而非直接模仿。
为保护知识产权,Google 已实现过滤器,对输出内容进行与现有作品的比对。用户必须遵守 Google 的服务条款和生成式 AI 禁止使用政策,该政策禁止侵犯知识产权和隐私权。平台还提供了举报机制,以处理可能侵犯权利的内容。
可用性与访问
Lyria 3 已在 Gemini 应用中向 18 岁以上的用户提供,支持英语、德语、西班牙语、法语、印地语、日语、韩语和葡萄牙语。该功能今日已在桌面端推出,未来几天将陆续在移动端上线。拥有 Google AI Plus、Pro 和 Ultra 订阅的用户拥有更高的使用额度。