Google|Lyria 3.5接入Gemini应用与API

PromptTree|阅读 0
2026/09/06 08:47
GoogleLyriaGemini音乐生成
9月4日,Google宣布其音乐生成模型Lyria 3.5已在Gemini应用与Gemini API上线,定位为目前听感最佳的一代,强调更富表现力的人声与更丰满的编曲;官方称对全球网络端与移动端用户可用,并面向Google Flow Music、Google AI Studio与Google Vids等入口开放。

AI音乐若只停在研究Demo,很难改写用户习惯;一旦进入日活入口与API账单,竞争才会变成「一句话出歌」与「进工程可改」两条线并行。9月4日,Google宣布其音乐生成模型Lyria 3.5已在Gemini应用与Gemini API上线。

Google将Lyria定位为音乐生成模型系列,3.5被描述为目前听感最佳的一代,强调更富表现力的人声与更丰满的编曲。Gemini应用侧可选择或描述风格、人声/器乐,使用模板快速生成背景乐、生日曲等,并可选择短轨或更长作品;同时面向Google Flow Music、Google AI Studio与Google Vids等入口开放。官方称对全球网络端与移动端用户可用。

产品与模型要点:

  1. 分发:Gemini应用、Gemini API,以及Flow Music、AI Studio、Vids等入口
  2. 听感:更强人声表现力与更丰满编曲(公司定位口径)
  3. 家族:Lyria 3短片段模型与Lyria 3.5完整歌曲模型并存
  4. 规格:后者可生成约数分钟、含主副歌结构的作品;支持文本与图像等多模态输入
  5. 输出:默认约44.1 kHz立体声,并可请求WAV等格式

所谓音乐生成进应用分发,白话是能力不再停在研究Demo,而是进到日活入口与API账单。Gemini应用侧用模板与风格描述降低上手成本;API与AI Studio则把同一能力交给开发者嵌进产品。消费级「一句话出歌」会继续抢注意力;专业DAW工具则继续抢「进工程可改」的工作流。

放在生成式媒体竞争上下文里,版权、艺人声音相似与平台安全策略,会决定产品能不能规模化商用。短片段与完整歌曲分模型,也意味着产品设计要在「快速试听」与「结构完整」之间分流。开发者侧则要看API配额、格式与授权套餐是否写进合同。

产业影响上,消费级AI音乐与专业工具并行深化。需要把边界读清楚:版权与安全策略以Google产品条款为准;听感「最佳」属公司定位口径。下一观察点是商业授权套餐与内容平台的过滤强度。