行业资讯

谷歌Lyria 3.5上线:一句话生成完整歌曲

Heooo 09月05日08时33分 2 阅读

「谷歌发布音乐生成模型Lyria 3.5,正式集成至Gemini应用与API,标志着其音乐AI从内部试验走向主流。该模型可生成包含副歌、桥段的长达数分钟完整歌曲,并支持文本与图像联合提示,生成内容嵌入SynthID水印,面向开发者开放多种调用接口。」

谷歌近日正式宣布,旗下最新音乐生成模型Lyria 3.5已在Gemini应用和Gemini API中同步上线。这标志着谷歌的AI音乐能力从内部实验工具Google Flow Music,正式迈入面向主流用户与开发者生态的新阶段。此次发布不仅为普通用户带来了更直观的音乐创作体验,也为开发者提供了灵活、可集成的生成式音乐接口。

在模型能力上,Lyria 3.5呈现出明显的分层设计。根据官方文档,此次共提供两种模型:Lyria 3 Clip(模型ID为lyria-3-clip-preview)始终生成30秒的循环和预览片段,适合快速试听和素材打磨;而Lyria 3.5(模型ID为lyria-3.5)则能生成包含数段副歌、桥段等完整结构的音乐,时长可达数分钟,覆盖从灵感草稿到成品歌曲的制作需求。这种区分让创作者既能快速迭代短片段,也能直接产出可发布级别的完整歌曲。

开发者的调用方式也相当多元。Lyria 3.5同步开放了Google AI Studio、Vertex AI及Gemini API等多个入口,便于不同层级和场景的开发者快速接入。输出格式上,两种模型默认生成MP3音频,其中Lyria 3.5还额外支持WAV格式输出,满足更高保真度的音频处理需求。值得注意的是,开发者可以在文本提示之外,最多同时提供10张图像,模型将结合视觉内容进行音乐创作,为多媒体联动生成开辟了新可能。

在内容安全与溯源方面,所有生成内容均通过统一的Interactions API进行调度,并嵌入SynthID隐形水印。该水印能够抵抗压缩、重采样等常见音频处理操作,从而在版权追踪和内容溯源环节发挥关键作用。这一设计既保障了创作者对生成内容的可控性,也为AI生成音乐的正规传播提供了技术信任基础。

业内人士认为,Lyria 3.5从实验走向产品化,反映了谷歌在生成式AI垂直场景中的快速落地策略。未来,个人创作者或只需要一句文字描述和几张参考图片,就能生成结构完整的歌曲。随着该模型接入Gemini生态,AI辅助音乐创作的门槛有望进一步降低,相关应用场景也将更加丰富。

# 谷歌 # Lyria 3.5 # AI音乐生成 # Gemini

来源:Heooo AI工具导航