Google DeepMind

Google Lyria 3 Pro 登場:AI 音樂生成從 30 秒片段走向三分鐘完整曲目

3 月 25 日 Google DeepMind 推出 Lyria 3 Pro,可生成長達 3 分鐘、含完整段落結構的曲目,較 Lyria 3 的 30 秒大幅躍進。本文看它進駐 Gemini、Vids、Vertex AI 與 ProducerAI 的布局、SynthID 浮水印與訓練資料立場。

Google Lyria 3 Pro 登場:AI 音樂生成從 30 秒片段走向三分鐘完整曲目 — 文章封面

3 月 25 日,Google DeepMind 推出 Lyria 3 Pro,這是它目前最先進的 AI 音樂生成模型:單次可生成長達 3 分鐘的完整曲目,而一個月前才登場的 Lyria 3,上限只有 30 秒。同一批更新把模型推進 Gemini app、Google Vids、Vertex AI、AI Studio,以及 Google 二月併購的 ProducerAI,等於一次把音樂生成從實驗性片段,推到可交付的成品長度。

對開發者而言,真正的訊號不是「會作曲」,而是音樂生成正式進入 Google 的 API 與企業渠道。Vertex AI 以公開預覽提供、Gemini API 開放模型存取,代表音訊生成開始被當成可計費、可規模化的基礎能力,與文字、影像站上同一等級。

從 30 秒到 3 分鐘:結構化生成

Lyria 3 Pro 對「長」的處理方式,不是把片段串接起來,而是對樂曲結構有更深的理解:使用者可以直接在 prompt 裡指定 intro、verse、chorus、bridge 等段落,模型負責段落之間的轉場,以及跨風格的實驗。TechCrunch 稱這是相較前代 30 秒上限的重大躍進。

對實際工作流的影響很直接。30 秒的輸出只能當素材或 demo;3 分鐘足以覆蓋一支短片、一段 podcast 開場,或遊戲內的場景配樂——後者正是 Google 在 Vertex AI 公開預覽中點名的使用案例。模型本身則透過 Music AI Sandbox 與音樂人共同打磨:葛萊美得主 Yung Spielburg 以 Lyria 為 DeepMind 短片《Dear Upstairs Neighbors》配樂,DJ 與製作人 François K 也用它完成了即將發行的歌曲。

進駐產品線與 API

這次一次推進的範圍值得逐項看:

  • Vertex AI:企業可按需求、大規模生成音訊(公開預覽)
  • AI Studio 與 Gemini API:開發者可搭配 Lyria RealTime,打造即時創作工具
  • Google Vids:當週起向 Workspace 客戶與 Google AI Pro、Ultra 訂閱者推出
  • Gemini app:付費訂閱者可生成較長曲目,官方點名 vlog、podcast 與教學影片
  • ProducerAI:二月併購的 agentic 音樂製作工具,免費與付費使用者全球可用

Gemini API 的 changelog 同日列出 lyria-3-pro-preview,確認 API 路徑與產品同步上線。這種「產品線先行、API 跟上」的節奏,與我們在開年觀察裡追蹤的 2026 年模型加速一致——差別在於,這次加速的是音訊。

訓練資料與版權立場

音樂模型躲不掉的問題是資料。Google 的說法是:訓練使用 YouTube 與 Google 依服務條款、合作夥伴協議及適用法律有權使用的素材;模型「不模仿特定藝術家」,若 prompt 中出現創作者名字,只作為廣泛的風格靈感,且輸出會經過與既有內容比對的過濾器。所有 Lyria 3 與 Lyria 3 Pro 的輸出,都嵌入 SynthID 浮水印。

產業背景讓這套設計顯得刻意謹慎:Spotify 已推出讓藝術家審視以自己名義發行歌曲的工具,Deezer 也建了協助其他串流平台偵測 AI 音樂的工具。Google 選擇「有權使用的素材、浮水印、不模仿」三件套,明顯想避開 Suno 與 Udio 身陷的訴訟區。

對開發者與創作者的意義

三個判斷。第一,音訊生成 API 化之後,成本結構開始可以比較——遊戲音效、影片配樂、podcast 片頭這類「夠好用就好」的需求會最先被吃掉,報價被迫往生成成本靠攏。第二,SynthID 成為出廠標配,代表 AI 音訊的偵測與揭露正在變成平台層的基礎設施,而不是個別公司的政策選項。第三,ProducerAI 的全球免費開放既是獲客手段也是護城河:當創作者的素材庫與工作流長在 Google 生態裡,轉換成本只會往上疊。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵