New 職場 AI 實戰課現正招生|立即報名 →

工具介紹

2026 AI 影片與圖像工具:Gemini Omni、Google Pics、Lyria

整理 2026 年最新的 AI 影片、圖像與音樂生成工具:Gemini Omni 1.1 Flash、Google Pics、Nano Banana 2 Lite、Lyria 3.5 與 Google Flow,並示範香港 Threads、Instagram 與 YouTube 創作者如何用這些工具製作貼文與短片。

2026 AI 影片與圖像工具:Gemini Omni、Google Pics 與 Lyria 介紹|AI Academy HK 文章封面

對香港的 Threads、Instagram 與 YouTube 創作者來說,2026 年最大的變化,是圖像、影片與音樂生成工具由「試玩」變成可以放進每週製作流程的工具。Google 在短短數個月內推出多款創作模型與應用程式,但名稱眾多,很容易混淆。本文根據 Google 與 Google DeepMind 官方公布的資料,整理每款工具的定位、功能與可用範圍,並提供香港創作者可以直接照做的工作流程。

本文資料查閱日期:2026 年 9 月 24 日。若你亦想了解另一個多模型創作平台,可以閱讀〈Higgsfield 是什麼?香港職場與行銷內容創作者完整介紹〉。

AI 影片、圖像與音樂工具比較表

工具 類型 推出日期 主要功能 可以在哪裡使用
Gemini Omni 1.1 Flash 影片生成與編輯 2026 年 8 月 27 日 場景延伸、首尾畫格、360p 草稿、4K 放大 Google Flow、Gemini 應用程式、Google AI Studio
Google Pics 圖像生成與編輯 2026 年 9 月 1 日 物件分割、圖中文字編輯與翻譯、團隊協作 pics.new、Google 文件與簡報
Nano Banana 2 Lite 圖像生成 2026 年 6 月 30 日 約 4 秒生成一張圖,適合大量草稿 Gemini 應用程式、Google 搜尋 AI 模式、Google AI Studio
Lyria 3.5 音樂生成 2026 年 7 月 29 日 旋律、歌詞與人聲改進,可控制節奏與長度 Google Flow Music
Google Flow AI 創意工作室 持續更新 整合影片與圖像生成,可自建創作工具 flow.google.com

Gemini Omni 1.1 Flash:可以用對話修改的影片生成模型

Gemini Omni 的主要功能

Gemini Omni 是 Google 把 Gemini 多模態推理與影片生成結合的模型。2026 年 6 月 30 日,Gemini Omni Flash 首次向開發者開放,官方價格為每秒影片輸出 0.10 美元。官方公布的強項包括用自然語言修改影片、結合圖像、文字與影片作參考以保持畫面一致,以及運用真實世界知識構建影片內容。

Omni 1.1 Flash 的新增功能

  • 場景延伸:模型可以參考前段最多 10 秒的內容,以每次 10 秒的方式延伸影片,總長度最多 40 秒。
  • 指定首尾畫格:提供開始與結束畫面,模型會生成兩者之間的連續影片,適合環繞鏡頭、推近鏡頭與無縫循環片段。
  • 360p 快速草稿:與標準 720p 相比,生成速度最多快 60%,成本只需三分之一,適合先測試分鏡。
  • 4K 放大:Google 八月更新摘要提到 Omni 1.1 Flash 支援清晰的 4K 放大。

Omni 1.1 Flash 已在 Google Flow、Google AI Studio、Gemini Enterprise Agent Platform 與 Gemini 應用程式提供。

Google Pics:在文件與簡報中直接製作圖像

Google Pics 是 Google Workspace 的圖像創作與編輯工具,以 Nano Banana 圖像模型為基礎。官方公布它會在數星期內逐步開放給 Google AI Pro 與 Ultra 訂閱用戶,以及大部分 Workspace 商業客戶。主要功能包括:

  • 物件分割:選取圖中某件物件單獨修改,而不影響其他部分,並可一次提出多項修改。
  • 圖中文字編輯與翻譯:直接修改或翻譯圖中的文字,同時保持原有設計與字體。
  • 團隊協作:與同事分享作品,並共同編輯同一張圖。
  • 多個版本:同一個提示詞會生成多個選擇。

Google Pics 既是獨立產品,亦已整合到 Google 文件與簡報,之後會加入 Google 雲端硬碟,可以在 pics.new 試用。對需要把同一張宣傳圖製作中英文版本的香港團隊來說,圖中文字翻譯功能特別實用。

Nano Banana 2 Lite:最快、最便宜的圖像模型

Nano Banana 2 Lite 是 Google Nano Banana 系列中速度最快、成本最低的圖像模型。官方公布它約 4 秒就可以完成文字生成圖像,開發者價格為每張 1K 解像度圖像 0.034 美元,並保留可靠的提示詞遵從度、角色一致性與清晰的圖中文字。Nano Banana 系列目前包括:

  • Nano Banana 2 Lite:重視速度,適合大量草稿與即時預覽。
  • Nano Banana 2:品質與成本最平衡的主力型號。
  • Nano Banana Pro:適合需要最精準控制的專業用途。

Nano Banana 2 Lite 已在 Google 搜尋 AI 模式與 Gemini 應用程式推出,官方亦表示會加入 NotebookLM、Google Photos、Google Flow 與 Google Ads 等產品。

Lyria 3.5 與 Google Flow:為短片製作配樂與自建工具

Lyria 3.5 是 Google 最新的音樂生成模型,在 Google Flow Music 推出。官方表示它改進了旋律結構、歌詞質素與人聲表現,讀音亦更準確,並可以更容易控制節奏快慢與歌曲長度。對短片創作者而言,這代表可以按影片長度生成合適的背景音樂,減少尋找授權音樂的時間。

Google Flow 則是 Google 的 AI 創意工作室。Google 在 2026 年 9 月分享了與時裝設計師合作的例子:設計師在 Flow 中用自然語言建立了虛擬造型與天橋佈置的專屬工具,無需任何程式經驗。

實際工作流程:一星期製作三條短片與九張社交媒體圖片

  1. 規劃內容:用 ChatGPT 或 Gemini 列出本週三個主題,每個主題寫一段三十秒腳本與三句貼文文案。
  2. 製作圖片:用 Nano Banana 2 Lite 快速生成多個構圖草稿,選定方向後用 Google Pics 修改細節,並把圖中文字翻譯成英文版本。
  3. 製作短片:用 Gemini Omni 1.1 Flash 以 360p 先測試分鏡,確定後再以標準解像度生成,並用首尾畫格功能製作開場與結尾。
  4. 加入配樂與旁白:用 Lyria 3.5 生成與影片長度相同的配樂,旁白可參考〈Gemini 3.8 語音生成〉。
  5. 剪接與發佈:在剪接軟件加入字幕與品牌標誌,由本人檢查文字、商標與事實後發佈,並按平台規定標示 AI 生成內容。

AI 創作工具的優點與限制

優點 限制與注意事項
大幅降低測試不同創意方向的成本 生成結果仍會出現錯字、手部變形與商標錯誤,發佈前必須檢查
Google Pics 可以直接修改與翻譯圖中文字 Google Pics 需要 Google AI Pro、Ultra 或 Workspace 商業方案
Omni 的 360p 草稿可以用較低成本測試分鏡 影片總長度有上限,長片仍需要剪接多段片段
Lyria 3.5 可以按長度生成配樂 商業使用前應閱讀最新使用條款,確認授權範圍

更多構圖與品牌視覺技巧,可以參考〈AI 圖像出圖避坑:市場人員實戰〉與〈Canva 與 AI:非設計人員也能製作專業品牌視覺〉。

如何開始學習用 AI 製作內容

工具會不斷更新,真正決定內容成效的是選題、節奏與持續發佈的流程。建議按你主要經營的平台選擇學習路線:

亦可以先瀏覽影音職場應用地圖與設計職場應用地圖,找出最適合你的使用場景。

不確定應該先學短片、Threads 還是 YouTube?歡迎透過 WhatsApp 查詢內容創作課程。

Timson Kwok 導師照片

本文作者

Timson Kwok

Timsondaily & Trafficholic 創辦人

Timson Kwok 是 Timsondaily 與 Trafficholic 創辦人,亦為 AI Academy HK 創辦團隊成員。他畢業於香港城市大學金融學,副修計算機科學,結合商業判斷與技術理解,專注把數碼市場推廣與 AI 應用落到真實業務場景。

他擁有十年數碼市場推廣經驗,服務超過一百位本地中小企客戶及跨國企業(MNC),熟悉香港市場的內容擴散、流量增長與轉化路徑。作為實戰派導師,他主張先以自身方法驗證成功,再把可複製的流程套用到企業,避免停留於純理論。

其個人品牌 Timsondaily 以全自然流量為主,於 Threads 達過千萬流量級別、Instagram 達近 200 萬級瀏覽,並將流量轉化至網站達過萬活躍使用者;同時營運 YouTube 頻道累積近十萬訂閱。這些經驗會直接轉化為課堂中可落地的策略、工具與執行節奏。

查看 Timson Kwok 導師簡介與實戰背景

常見問題

關於本文的常見問題

2026 年有哪些新的 AI 影片生成工具?

Google 在 2026 年推出 Gemini Omni Flash 與 Omni 1.1 Flash,可以用文字、圖像與影片作參考生成影片,並用自然語言對話修改影片;Omni 1.1 Flash 另加入場景延伸、首尾畫格指定與 4K 放大等功能。

Google Pics 是什麼?

Google Pics 是 Google Workspace 在 2026 年 9 月 1 日推出的圖像創作與編輯工具,以 Nano Banana 模型為基礎,可以分割並修改圖中物件、直接編輯或翻譯圖中文字,並與團隊共同編輯同一張圖。

Google Pics 要付費嗎?

Google 公布 Google Pics 會在數星期內逐步開放給 Google AI Pro 與 Ultra 訂閱用戶,以及大部分 Workspace 商業客戶,並已率先整合到 Google 文件與簡報,之後會加入 Google 雲端硬碟。

Lyria 3.5 可以做什麼?

Lyria 3.5 是 Google 在 2026 年 7 月 29 日於 Google Flow Music 推出的音樂生成模型,改進了旋律結構、歌詞質素、人聲表現與讀音,並可以控制節奏快慢與歌曲長度。

用 AI 生成的圖像與影片可以直接用作商業宣傳嗎?

使用前應先閱讀各工具的最新使用條款,確認商業使用權利,並由本人檢查商標、肖像、文字與事實是否正確。涉及真實人物或客戶資料的素材,應先取得授權。

想學習用 AI 製作短片與社交媒體內容,應該報讀什麼課程?

可以參考 AI Academy HK 的 AI 短視頻入門線上課程、Threads 自動營運系統打造班與香港 AI YouTube 變現課程,按你主要經營的平台選擇。

分享本文

AI.Academy

想把方法用在工作上?

報讀 AI Academy HK 實戰課,或先了解香港 AI 課程與企業培訓方案。

  • 易上手
  • 小班實戰
  • 帶走作品

不確定應該從哪一堂開始?

MISA:We're here to help