谷歌发布Lyria 3.5音乐模型 Gemini集成支持生成完整歌曲
谷歌9月5日推出音乐生成模型Lyria 3.5,集成于Gemini应用与API中。该模型可生成包含副歌、桥段等结构的数分钟完整歌曲,支持文本加最多10张图像提示,输出MP3或WAV格式,并嵌入SynthID水印用于版权溯源。开发者可通过Google AI Studio、Vertex AI等接口调用。
谷歌今日(9月5日)正式发布公告,其最新音乐生成模型Lyria 3.5已上线Gemini应用及Gemini API。此举标志着谷歌音乐AI能力从内部实验工具Google Flow Music正式迈入主流用户与开发者生态,成为面向大众的公开服务。
根据官方技术文档,本次共开放两种模型规格。其中Lyria 3 Clip(模型ID:lyria-3-clip-preview)专门生成30秒的循环片段,适用于快速预览与素材拼接;而Lyria 3.5(模型ID:lyria-3.5)则具备完整歌曲创作能力,可输出包含多段副歌、桥段等复杂结构的数分钟长曲目。两者默认输出MP3格式音频,Lyria 3.5额外支持WAV无损输出。
在功能设计上,Lyria 3.5支持多模态提示——开发者可在文本描述之外附加最多10张参考图像,模型将综合视觉与文本信息进行音乐创作。所有生成任务均通过Interactions API统一调度管理,该接口同时面向Google AI Studio、Vertex AI及Gemini API开放调用。
值得注意的是,所有生成内容均内置SynthID隐形数字水印。该技术由谷歌DeepMind开发,具备较强的鲁棒性,可有效抵抗压缩、重采样等常见音频后期处理,为版权追踪与内容溯源提供了技术保障。目前官方文档尚未披露具体的定价策略与计费模式。
本次发布将谷歌的AI音乐生成能力直接推至C端用户与B端开发者面前。对于独立音乐人而言,这意味着从灵感构思到小样输出的链路进一步缩短;而对应用开发者来说,通过API集成AI作曲功能的技术门槛也同步降低。随着Lyria 3.5的落地,AI辅助音乐创作领域的产品竞争料将进入新阶段。