Google 在 2026 年 9 月 4 日宣布,音樂生成模型 Lyria 3.5 已進入 Gemini App 與 Gemini API。這代表它不再只停留在 Google Flow Music 這類創作工具,而是同時面向一般使用者、開發者與影片製作者,讓文字或圖片都能成為歌曲的起點。
Lyria 3.5 這次新增了什麼?
Google 將 Lyria 3.5 描述為目前音質最佳的音樂生成模型,重點包括更有表現力的歌聲、更豐富的編曲,以及比前代更高的聲音保真度。在 Gemini App 中,使用者可以選擇或描述曲風,切換人聲與純樂器,也能從背景音樂、生日歌曲等模板開始。
API 文件則把能力說得更具體:模型可由文字或圖片生成 44.1 kHz 立體聲音訊,支援歌詞與主歌、副歌、橋段等完整歌曲結構。開發者也能提供最多十張圖片,讓畫面內容成為音樂方向的參考。這讓它更適合短片配樂、品牌聲音草稿、遊戲原型與互動內容。
在哪裡可以使用?
Google 表示,Lyria 3.5 已在全球 Gemini 網頁版與手機 App 提供,也可透過 Google AI Studio、Gemini API、Google Vids 與 Flow Music 使用。對一般使用者來說,入口是 Gemini App;對開發者來說,模型 ID 是 `lyria-3.5`,目前仍屬 Preview。
API 與 App 的使用方式不完全相同。Gemini App 著重選曲風、歌聲與長短的低門檻操作;API 則提供把音樂生成嵌入產品的路徑。團隊在接入前仍要確認帳戶資格、區域可用性、輸出格式與當期模型文件,不能把全球宣布直接解讀成每個帳戶同時開通。
它還不是完整的音樂編輯器
目前公開文件顯示,Lyria 3.5 的 API 以單次生成為主;如果副歌或歌詞方向不對,通常需要重新生成,而不是像傳統 DAW 一樣只替換一個段落。Preview 模型的限制、價格與生命週期也可能再調整,正式產品不應把一次輸出的結果當成永久穩定介面。
Google 同時保留內容安全邊界,包括阻擋指定藝術家聲音模仿與受版權保護歌詞的請求。官方也為生成音訊加入 SynthID 標記。這些機制有助於降低冒用與來源混淆,但不等於自動解決商用授權、素材權利或作品責任;發布前仍要自行確認使用權。
對創作者與開發者的實際意義
Lyria 3.5 的關鍵變化不是「AI 會作曲」這件事本身,而是完整歌曲生成被放進一般聊天介面與可程式化 API。創作者可以更快做出配樂方向,開發者可以把圖片、文字與音訊串成產品流程;但真正可用的工作流仍需要人工挑選、剪輯、版權檢查與版本管理。把它當成快速產生草稿的創作工具,比把它當成無需審核的自動音樂製作人更準確。
Google 官方公告: Create your best tracks yet with Lyria 3.5 in Gemini
