概览
Google DeepMind 的音乐生成模型线,官网当前主推 Lyria 3.5,在音乐性、人声与曲长可变性上相比前代明显改进,可生成最长约 3 分钟的曲目,支持多语种人声与自定义歌词,还能把一张图片转成配乐;可在 Google Flow Music、Gemini、YouTube Shorts(Dream Track)、Google Vids 与 Google AI Studio 使用,所有成品均带 SynthID 水印。开发者侧,Gemini API 于 2026-03-25 上线 Lyria 3 的两个端点:lyria-3-clip-preview 固定产出 30 秒片段(MP3,$0.04 / 首),lyria-3-pro-preview 产出带主歌、副歌与桥段的完整歌曲(MP3 或 WAV,时长可由提示词控制,最多可输入 10 张图片,$0.08 / 首),均为 44.1 kHz 立体声,歌词语言跟随提示词语言。
- 模态
- 音频
能力
- 文生音乐,可生成最长约 3 分钟的完整曲目
- 支持多语种真实人声,歌词语言跟随提示词语言
- 理解主歌、副歌、桥段等结构,可用 [Verse]、[Chorus] 等标签或时间戳指挥编排
- 可把上传的图片转成对应氛围的配乐
- 输出 44.1 kHz 高保真立体声,可指定纯伴奏;成品带 SynthID 水印
