产品简介
Lyria 3.5 是 Google DeepMind 的音乐生成模型。2026 年 7 月 29 日先在有声产品 Google Flow Music 上线,同年 9 月 3 日进入 Gemini API 公开预览,9 月 4 日面向 Gemini 应用全体用户开放。它按文本提示合成音乐,输出 44.1kHz 立体声,可以带上人声、与时间轴对齐的歌词和完整编曲。
DeepMind 的模型页把这一代定位为「目前最强的音乐生成模型」,重点改进落在人声表现力和编曲层次上,音频保真度相比 Lyria 2 也有明显提升。
核心功能
- 文本与图片都能当输入:提示词可以描述风格、情绪、乐器与曲式;也可以一次上传最多 10 张图片,让模型照着画面气氛作曲。
- 歌词与结构可控:可以自己写词,也可以让模型按主题生成。用 Verse、Chorus、Bridge 这类段落标记安排曲式,还能用时间戳指定某一刻发生什么,比如第几秒进鼓。
- 长度从 30 秒到 3 分钟:API 侧提供两个模型。`lyria-3-clip-preview` 固定输出 30 秒片段,适合循环与试听;`lyria-3.5` 生成带主歌、副歌、桥段的完整歌曲,时长约两分钟级,DeepMind 模型页给出的上限是三分钟。
- 输出格式:默认输出 MP3,Lyria 3.5 另外提供 WAV 选项,方便进后期流程。
- 语言跟随提示:用哪种语言写提示,生成的歌词就是哪种语言,模型会相应调整唱腔与发音。
- 全量 SynthID 水印:所有生成的音频都嵌入 SynthID 水印,人耳不易察觉,平台和听众可以据此判断音频是否由 AI 生成或编辑。
- 安全过滤:所有提示都过安全过滤,点名特定艺人音色、生成受版权保护歌词的请求会被拦下。生成前模型会先推演一遍音乐结构。
适合谁用
以下类型的用户会特别受益于 Lyria 3.5:
- 给视频配定制背景音乐,或用内置模板快速出一首生日歌
- 制作品牌音效与个性化铃声
- 独立创作者在没有配乐预算的情况下完成短片的原创配乐
- 拿一批氛围图让模型照图作曲,为视觉项目配同一调性的声音
优点亮点
- 44.1kHz 立体声加可控曲式,已经能进真实剪辑流程
- 歌词与段落标记可控,不是纯随机出稿
- 提示词语言决定歌词语言,中文创作者可以直接写中文提示
- 全量 SynthID 水印,商用溯源有据可查
- Gemini 应用内对全体用户开放,试错成本低
价格与方案
Gemini 应用内对全体用户开放,普通账号即可使用。开发者在 Google AI Studio 与 Gemini API 中按 Google 的音频生成定价计费,企业侧可通过 Vertex AI 部署。
总结与建议
Lyria 3.5 把音乐生成从「演示可用」推到了「能进真实剪辑流程」。44.1kHz 立体声、可控曲式、语言跟随,让它在短视频配乐和广告小样上已经够用。当前版本是单轮生成,同一片段做多轮迭代修改这条路径尚未提供;同样的提示多次调用结果也会有差异。想要稳定出稿,建议把提示写细、一次到位。
版本演进
- Gemini 应用全量开放 (2026-09-04):面向全体 Gemini 用户开放,加入风格选择、人声或器乐切换、长短曲目与模板
- Gemini API 公开预览 (2026-09-03):开发者可通过 `lyria-3.5` 与 `lyria-3-clip-preview` 两个模型 ID 调用
- Lyria 3.5 首发 (2026-07-29):在 Google Flow Music 上线,改进覆盖音乐性、歌词与人声质量