Google Omni × Higgsfield 實測教學

重點摘要:Google Omni 可以幫你將普通口播片變成帶動畫風格嘅影片——我親自試過,以下係完整流程同我嘅實測感受。好多人喺網上分享呢個方法 ,但係冇人同你講實際嘅好處同壞處。開始之前:先用 CapCut 處理原片不論你選用下面邊個方法,呢個步驟都係必須嘅。拍完口播片之後,先去 CapCut 做基本剪輯:

Google Omni 可以幫你將普通口播片變成帶動畫風格嘅影片
——我親自試過,以下係完整流程同我嘅實測感受。
好多人喺網上分享呢個方法 ,但係冇人同你講實際嘅好處同壞處。


開始之前:先用 CapCut 處理原片

不論你選用下面邊個方法,呢個步驟都係必須嘅。

拍完口播片之後,先去 CapCut 做基本剪輯:

  • 剪走所有停頓位置

  • 剪走 NG 或者你唔要嘅部分

  • 確保整條片節奏流暢

點解要先喺 CapCut 剪好?
因為 AI 係根據你嘅原片畫面去生成動畫,你入咩佢就用咩。廢料入去,出嚟都係廢料。

剪好之後,你有兩個方向可以選擇。


方法一:Google Omni(適合追求高質感效果)

Google Omni 係 Google 旗下嘅 AI 影片生成工具,可以將你嘅影片重新以你指定嘅視覺風格生成出嚟,效果可以非常靚,但流程係兩個方法裏面比較費時嘅一個。

使用前提: 需要 Google AI Plus、Pro 或 Ultra 訂閱。

完整步驟

第一步:將剪好嘅片切成每 10 秒一段

Omni 每次最多處理 10 秒嘅片段,最高解析度係 720p。所以你要先喺 CapCut 將整條片分割成多個 10 秒以內嘅短段,再逐段處理。

第二步:搵你鍾意嘅 IG 影片風格

去 IG 或者 YouTube 搵一條你想模仿風格嘅片,
例如:水彩動畫風、漫畫線條風、電影 Cinematic 風等。

第三步:用 Gemini 生成風格指令

將嗰條參考片 send 俾 Gemini,叫佢幫你生成一段影片風格嘅提示詞(Prompt)。生成出嚟大概係類似:「Anime watercolor style, soft warm lighting, hand-drawn textures, smooth transitions...」之類。

呢個 Prompt 之後會用喺 Omni 入面。

第四步:去 Google Omni 網站逐段 Upload

gemini.google 進入 Omni 功能,將你每一條 10 秒片逐條 upload,
並且附上你剛才生成嘅風格 Prompt,然後生成。

第五步:Download 所有片段,回 CapCut 接駁

生成完成之後,將所有片段 download 返嚟,再喺 CapCut 按原本嘅順序接駁成完整條片。

第六步:覆蓋原聲 + 加字幕

呢一步係最關鍵嘅。Omni 生成嘅影片會將你原本把聲完全扭曲,語言亦都會失真——廣東話更加係幾乎完全唔識讀。所以你必須將你原本錄音嘅人聲貼返去 Omni 生成嘅影片上面覆蓋,然後自行加上字幕,整條片先算完成。

實測感受

Omni 生成出嚟嘅動畫效果可以真係好靚,而且因為佢係重新 generate 成條片而唔係只係改畫面濾鏡,所以佢可以做到多角度分鏡,視覺上比其他工具更有層次感。

但係實際操作有幾點要有心理準備:

廣東話係弱點。 Omni 基本上係理解唔到廣東話內容,生成出嚟嘅動畫人物嘴型同你講嘅內容完全對唔上,所以覆蓋原聲呢個步驟係必須嘅,無得慳。

對聲比你想像中費時。 Omni 重新生成嘅片,佢嘅時間長度同你原片唔一定完全一致,你會發現有啲位置原聲係「多咗」或者「缺咗」,需要手動花時間逐段對位。呢個係我覺得最花時間嘅地方。



方法二:Higgsfield Shorts Studio

Higgsfield 係一個專門做 AI 短片創作嘅平台,
入面有 Shorts Studio 功能(背後都係用緊Omni Model),可以將你成條口播片一次過轉換成動畫風格,流程比 Omni 快好多。

使用前提: 需要 Higgsfield 付費帳戶並啟用 Shorts Studio。

完整步驟

第一步:去 Higgsfield 註冊並付費

higgsfield.ai 註冊帳戶,選擇適合嘅付費計劃,然後進入 Shorts Studio。每次生成會消耗 Credits,生成前佢會告訴你需要幾多。

第二步:選擇風格模板

Shorts Studio 入面有大量現成嘅 Preset,唔同風格、唔同節奏、唔同平台格式都有。你可以直接揀一個你鍾意嘅模板使用。

第三步:(如果冇你鍾意的模板)上載自訂風格參考

如果現成模板唔合你意,你可以上載 4 至 6 張你鍾意風格嘅參考圖片,Shorts Studio 會從中學習色調、轉場、節奏等元素,幫你建立一個自訂嘅 Preset。

第四步:Upload 完整口播片

將你剪好嘅完整口播片 upload 上去,唔需要切段——佢支援最長 2 分鐘嘅影片。然後啟動生成,等佢自動處理。

第五步:Download + 覆蓋原聲 + 加字幕

跟方法一一樣,Higgsfield 生成出嚟嘅片同樣會令把聲同語言失真,你需要 download 返嚟,去 CapCut 覆蓋原聲,然後加字幕。

實測感受

操作效率明顯高過 Omni。 唔需要逐段處理,直接 upload 成條片,大大減省咗切段、逐條 upload 同接駁嘅時間,對於要大量出片嘅人嚟講係明顯優勢。

現成 Preset 多,上手容易。 就算唔識設計,都可以喺幾分鐘內搵到合適風格。

同樣唔識廣東話。 呢一點同 Omni 一樣,生成嘅影片把聲同語言都係會失真,覆蓋原聲係必要步驟。

Credit 使用要留意。 係付費服務,生成前記得確認 Credit 用量,唔好盲目試太多次。



最後想說的

用 AI 做動畫口播片,最大嘅現實係:廣東話目前係兩個工具嘅共同弱點。

無論你用 Omni 定 Higgsfield,生成出嚟嘅片把聲同語言都係會失真,
所以覆蓋原聲同加字幕係唔可以跳過嘅步驟。流程上會比你預計多一些功夫,特別係對聲呢個環節。

如果你想試玩吓,咁樣就絕對冇問題。
但係如果你係想取代日常出片嘅工作,就絕對幫你唔到,仲增加咗剪接工作時間,同埋太精美嘅動畫太假其實觀眾唔會睇落去。