谷歌发布Lyria 3.5,���AI唱歌更好听
AI音乐开始拼人声了
谷歌在7月30日发布了新一代AI音乐模型Lyria 3.5。这个版本的主攻方向很明确——让AI唱歌更好听,更好用。
升级集中在四个方向。首先是音乐表现力,生成的旋律结构更复杂更自然,不是一段简单循环来回放了。其次是歌词质量,Prompt理解更准确,段落组织更合理,歌词不再像机翻。第三是创作控制,用户可以通过自然语言持续跟模型对话来修改歌曲——改旋律、改歌词、改风格、改节奏,不用每次从头来过。
但这次最大的升级是人声。 谷歌说新模型生成的人声更自然,更有情绪表达力,发音准确率也提高了,听起来更接近真人演唱而不是电子合成音。这一点对AI音乐产品来说可能是最关键的一步——过往AI音乐最大的槽点就是「一听就是AI唱的」,Lyria 3.5想在这个点上打破用户的成见。
Lyria系列的迭代速度不慢。今年2月出了Lyria 3,3月底又发Lyria 3 Pro。短短不到半年,Google已经把歌曲时长从30秒拉到3分钟,支持了完整的歌曲结构定义,现在又开始打磨人声和歌词质量。这次Lyria 3.5没有秀任何基准测试成绩,而是把重心完全放在了用户体验上——说明谷歌对AI音乐的判断已经变了:模型能力还能再提,但真正决定产品胜负的是好不好用。
AI音乐这条赛道已经挤满了人。OpenAI有自己的多模态生成能力,Suno和Udio两家创业公司势头很猛,各自都有忠实用户群。谷歌选择在这个时点放大招,策略很清晰——不打算在单一技术指标上和别人卷,而是想做那个「最好用的一站式AI音乐平台」。
Flow Music现在是Google Labs创意工具矩阵的一部分,和Flow视频生成平台搭档,一起构建谷歌的AI内容创作生态。谷歌不想只做最好的搜索引擎,它想做最好的AI创作工具箱。 音乐、视频、图像、写作——每个内容形态配一个AI原生工具,然后全部整合到一个生态里。这个战略野心不小,但能不能落地,取决于Lyria 3.5的真实体验能不能让用户真正喜欢上用AI做出来的歌。