AI 產業趨勢AI 趨勢洞察

Google 生成式影音再進化:Veo 3.1 Lite、Gemini Omni、Lyria 3.5 有哪些新能力?

Home » AI 趨勢洞察 » Google 生成式影音再進化:Veo 3.1 Lite、Gemini Omni、Lyria 3.5 有哪些新能力?

作者:Sunny Shih

從文字、圖片到影片與音樂,Google 正快速補齊生成式 AI 的多媒體創作能力。

近期推出的 Veo 3.1 Lite、Gemini Omni 與 Lyria 3.5,分別從影片生成成本、對話式影音創作與音樂生成切入。與過去追求「能不能生成」相比,這波更新更明顯地把重點放在 生成效率、可編輯性與創作控制,讓 AI 更容易進入實際的內容製作流程。

Google 正在補齊一套完整的生成式媒體工具

如果把這幾項更新分開看,很容易變成三則不同的 AI 模型新聞。

放在一起看,產品定位其實相當清楚。

產品主要能力適合情境
Veo 3.1 Lite高效率 AI 影片生成大量影片生成、API、產品開發
Gemini Omni對話式影片生成與編輯創作者、Marketing、快速迭代
Lyria 3.5AI 音樂生成配樂、歌曲與音樂內容製作

從 Video Generation 到 Editing,再延伸到 Music Generation,Google 正把原本分散的生成能力,逐步帶進完整的 Creative Workflow。


✦延伸閱讀:【Google Cloud NEXT 2026】企業級 AI Agent 時代來臨:關鍵趨勢與應用全解析!

Veo 3.1 Lite:讓 AI 影片生成更容易規模化

Veo 3.1 Lite 的關鍵不在於做出另一個更大的 Video Model,而是降低生成影片的成本門檻

Google 將 Veo 3.1 Lite 定位為目前最具成本效益的 Veo 模型。相較 Veo 3.1 Fast,官方表示其成本降低超過 50%,同時維持相同的生成速度。

目前支援:

  • Text-to-Video
  • Image-to-Video
  • 16:9、9:16
  • 720p、1080p
  • 4、6、8 秒影片

並可透過 Gemini API paid tier 與 Google AI Studio 使用。Google 官方 Veo 3.1 Lite 介紹

這讓 Veo 的應用情境開始從「生成一支 AI 影片」,進一步延伸到需要大量內容的場景。

例如品牌可以根據不同商品建立多版本 Product Video;廣告團隊可以快速測試不同 Creative;開發者則可以直接把 Video Generation 整合進自己的產品。

當影片生成進入這些情境,衡量標準自然不再只有畫質。

生成速度與每支影片的成本,也開始成為產品能力的一部分。

Gemini Omni:影片不只生成一次,而是可以繼續「聊著改」

另一條路線則是 Gemini Omni。

如果說 Veo 3.1 Lite 解決的是「如何有效率地生成影片」,Gemini Omni 更接近解決「生成之後怎麼繼續創作」。

Gemini Omni 將影片生成、理解與編輯整合進 Gemini 的對話體驗,使用者可以搭配文字、圖片與影片進行創作,也能透過後續指令持續修改內容。Gemini 官方影片生成介紹

過去使用 AI Video Model,常見流程是:

寫 Prompt → Generate → 不滿意 → 改 Prompt → 重新 Generate

Gemini Omni 想做的則更接近:

先產生 → 修改背景 → 調整人物 → 改變場景 → 繼續完善

也就是把影片生成從一次性的 Prompt Interaction,轉變成持續性的 Conversational Creation

對 Marketing 或 Creative Team 而言,這個改變可能比單純提升一次生成的品質更實際。

因為真實的內容製作,本來就不是一次完成,而是不斷 Review、修改與迭代。

Lyria 3.5:Google 把 AI 創作延伸到音樂

影像之外,Google 也持續更新 Lyria 音樂生成模型。

最新的 Lyria 3.5 進一步改善 Musicality、Lyrics、Vocals 與 Creative Control,並導入 Flow Music。Google 官方 Lyria 3.5 介紹

這次更新特別強調幾個面向:

更自然的音樂結構、更好的歌詞遵循、更具表現力的人聲,以及對 Tempo 與 Duration 更細緻的控制。

這延續了 Google 在 Lyria 系列上的發展方向。

AI 音樂生成已經不只是輸入:

「幫我做一首輕快的電子音樂。」

而是逐漸可以進一步指定歌曲結構、速度、長度與演唱方式。

對影片製作者來說,這也讓 AI Creative Workflow 多了一塊重要拼圖——Sound

從影片到音樂,Google AI 創作流程正在成形

把三項產品放回實際內容製作流程,就能更清楚看出差異:

Concept

Veo 3.1 Lite:快速產生影片

Gemini Omni:透過對話持續修改

Lyria 3.5:加入音樂與聲音創作

Final Content

這並不代表每一個專案都需要同時使用三項工具,而是 Google 的生成式 AI 版圖正逐漸涵蓋不同 Creative Stage。

其中也可以看到三個值得注意的方向。

影片生成開始進入「成本競爭」

Veo 3.1 Lite 明確把 Cost Efficiency 拉到產品定位前線。

這對企業尤其重要。

當 AI Video 從偶爾生成幾支 Demo,進入廣告素材、社群內容、商品影片等大量 Production 場景後,「生成一支影片要多少錢」會直接決定 AI 能不能真正 Scale。

AI 創作介面從 Prompt 走向 Conversation

Gemini Omni 則反映另一個轉變。

使用者不需要一次寫出完美 Prompt,而可以像與創意夥伴溝通一樣,不斷告訴 AI:

保留這個、修改那個、換一種呈現方式。

這讓 Prompt Engineering 的重要性降低,創作本身重新成為焦點。

多模態生成開始走進同一個 Workflow

影片、圖片、音樂過去往往是不同的生成工具。

現在 Google 正逐漸把它們放進更連續的 Creative Experience。

對企業來說,未來評估生成式 AI 工具時,也不一定只比較「哪個模型生成品質最高」,而會開始比較:

哪一套 AI 能真正融入既有的 Content Workflow?

Veo 3.1 Lite、Gemini Omni、Lyria 3.5 怎麼選?

如果是開發者或企業團隊,可以先從使用情境判斷。

如果你的需求是…可以優先評估
大量、自動化生成短影片Veo 3.1 Lite
透過對話反覆生成與修改影片Gemini Omni
產生歌曲、音樂或影音配樂Lyria 3.5
建立完整 AI Creative Workflow搭配多項模型與工具

與其問「哪一個模型最好」,更適合問:

目前 Content Workflow 的瓶頸在哪裡?

是影片生成太慢、修改成本太高,還是影音內容缺少音樂製作能力?

模型的選擇應該從這個問題開始。


✦延伸閱讀:Workspace Intelligence 是什麼?Google 如何讓 Gemini 真正理解你的工作脈絡

FAQ:Google 生成式影音 AI 常見問題

Veo 3.1 Lite 是什麼?

Veo 3.1 Lite 是 Google 強調成本效率的 AI 影片生成模型,支援 Text-to-Video、Image-to-Video,以及 720p/1080p、橫式與直式影片生成。

Veo 3.1 Lite 和 Gemini Omni 有什麼不同?

Veo 3.1 Lite 更偏向影片生成模型與 API 應用;Gemini Omni 則著重在 Gemini 中透過對話生成、理解與持續修改影片。

Lyria 3.5 可以生成什麼?

Lyria 3.5 用於 AI 音樂生成,Google 在新版中進一步強化 Musicality、Lyrics、Vocals,以及 Tempo、Duration 等 Creative Control。

企業可以怎麼使用這些生成式 AI?

常見應用包括社群短影音、廣告素材、商品影片、Personalized Content、影音配樂與 Creative Prototyping。實際導入時則應同時評估生成品質、成本、速度與既有 Content Workflow。

AI 創作的下一階段,不只是「生成得更好」

Veo 3.1 Lite、Gemini Omni 與 Lyria 3.5 的更新,呈現的是 Google 對生成式媒體不同層面的布局。

Veo 3.1 Lite 降低大量影片生成的成本;Gemini Omni 讓影片可以透過對話持續修改;Lyria 3.5 則把 AI 創作延伸到更完整的音樂生成。

當生成品質逐漸提升,下一階段的競爭重點也開始改變。

企業真正需要的,不一定是另一個更會「生成」的 AI。

而是一套能從生成、修改到規模化產出,真正進入內容製作流程的 AI 工具。

iKala,企業轉型的 AI 顧問!

身為 Google Cloud Premier Partner,iKala 不僅是您導入工具的推手,更是企業在雲端數位轉型旅程中的技術後盾。iKala 透過深度整合 Google Workspace 與 Google Cloud Platform 全球基礎設施,協助企業建構高可用性且具備高度彈性的現代化辦公環境。從基礎的混合雲架構設計、Identity & Security (IAM) 身分資安控管,到進階的 BigQuery 建置,我們專精於打破資料孤島,讓企業能利用 Gemini 模型實現自動化工作流與客製化 AI 模型開發。

iKala 提供從初期架構盤點、中期的 PoC 技術驗證,到後期在地化技術支援與成本優化建議的「一站式陪跑服務」,致力於降低導入門檻並確保轉型路徑與商業目標一致。選擇 iKala,您獲得的不只是領先的 AI 解決方案,更是加速創新、提升全球營運效率的長期策略盟友。

如果您正在尋找能加速創新與提升營運效率的 AI 解決方案,歡迎聯繫 iKala,獲得量身打造的技術建議與實作協助。

Contact iKala