谷歌釋出Lyria 3.5,���AI唱歌更好聽
AI音樂開始拼人聲了
谷歌在7月30日釋出了新一代AI音樂模型Lyria 3.5。這個版本的主攻方向很明確——讓AI唱歌更好聽,更好用。
升級集中在四個方向。首先是音樂表現力,生成的旋律結構更復雜更自然,不是一段簡單迴圈來回放了。其次是歌詞質量,Prompt理解更準確,段落組織更合理,歌詞不再像機翻。第三是創作控制,使用者可以透過自然語言持續跟模型對話來修改歌曲——改旋律、改歌詞、改風格、改節奏,不用每次從頭來過。
但這次最大的升級是人聲。 谷歌說新模型生成的人聲更自然,更有情緒表達力,發音準確率也提高了,聽起來更接近真人演唱而不是電子合成音。這一點對AI音樂產品來說可能是最關鍵的一步——過往AI音樂最大的槽點就是「一聽就是AI唱的」,Lyria 3.5想在這個點上打破使用者的成見。
Lyria系列的迭代速度不慢。今年2月出了Lyria 3,3月底又發Lyria 3 Pro。短短不到半年,Google已經把歌曲時長從30秒拉到3分鐘,支援了完整的歌曲結構定義,現在又開始打磨人聲和歌詞質量。這次Lyria 3.5沒有秀任何基準測試成績,而是把重心完全放在了使用者體驗上——說明谷歌對AI音樂的判斷已經變了:模型能力還能再提,但真正決定產品勝負的是好不好用。
AI音樂這條賽道已經擠滿了人。OpenAI有自己的多模態生成能力,Suno和Udio兩家創業公司勢頭很猛,各自都有忠實使用者群。谷歌選擇在這個時點放大招,策略很清晰——不打算在單一技術指標上和別人卷,而是想做那個「最好用的一站式AI音樂平臺」。
Flow Music現在是Google Labs創意工具矩陣的一部分,和Flow影片生成平臺搭檔,一起構建谷歌的AI內容創作生態。谷歌不想只做最好的搜尋引擎,它想做最好的AI創作工具箱。 音樂、影片、影象、寫作——每個內容形態配一個AI原生工具,然後全部整合到一個生態裡。這個戰略野心不小,但能不能落地,取決於Lyria 3.5的真實體驗能不能讓使用者真正喜歡上用AI做出來的歌。