Gemini AI 影片教學|讓滷汁寫出中文字、小籠包排成 TAIWAN,兩組提示詞免費公開
2026-08-05
FuFu
33
Gemini 的文字不只能當字幕,也能變成滷汁、食物與場景的一部分。本文公開兩組 10 秒 AI 影片完整提示詞,示範如何讓滷汁寫出「滷霸」、讓小籠包排列成「TAIWAN」,並整理文字生成常見錯誤與修改方法。
YT範例影片: https://www.youtube.com/watch?v=gyeZASpHVEE
AI 影片的文字,不一定只能像字幕一樣浮在畫面上。
它也可以是滷汁、食物、煙霧、光影,甚至直接成為整支影片的主角。
這次我使用 Gemini 製作了兩段 10 秒的美食文字動畫:第一段讓滷汁在白瓷盤上寫出「滷霸」,第二段則讓一顆顆小籠包排列成「TAIWAN」。
Gemini 在文字呈現上可以玩出很多不同形式。整體的動態控制與穩定度雖然還不一定比得上 Seedance 2.0,但它對繁體中文提示詞的理解確實很不錯,尤其適合拿來嘗試「文字與場景融合」這類創意效果。
這篇會拆解我怎麼設計提示詞,並把影片使用的兩組完整提示詞直接公開。想測試的人可以直接複製,再替換成自己的品牌、食物或文字。
不過先講在前面:AI 影片的文字仍然不是百分之百正確。如果同一個字連續生成很多次都錯,可能不是你的提示詞寫得不好,而是模型現階段對那個字的生成不穩定。遇到這種情況,與其一直燒生成次數,不如直接換字、縮短文字,成功率通常會高很多。
這次不是「在影片上加字」,而是讓文字長在場景裡
一般的文字動畫,常見做法是直接要求 AI:
畫面最後出現「滷霸」兩個字。
這種寫法雖然簡單,但 AI 很容易生成普通印刷字、浮空字幕,甚至突然冒出不相關的 Logo。
我這次改用另一種思考方式:先決定文字由什麼材質構成,再描述它如何形成。
- 「滷霸」不是普通字體,而是主廚用滷汁畫在白瓷盤上的醬汁擺盤。
- 「TAIWAN」不是後製標題,而是由一顆顆獨立的小籠包逐格排列而成。
當文字擁有材質、重量、光澤與形成過程,它就不再只是字幕,而會真正成為畫面的一部分。
這也是這類影片最值得玩的地方。
寫這類提示詞,我會先抓住 5 個重點
1. 先定義「文字是什麼做的」
不要只寫「出現文字」,要明確指定文字的材質。
例如:
- 滷汁寫成的字
- 小籠包排列成的字
- 奶泡形成的字
- 霓虹燈管構成的字
- 花瓣落下後拼成的字
- 道路與車流組成的字
材質越符合場景,畫面越自然,也越容易產生記憶點。
2. 寫清楚文字形成的動作
AI 不只要知道最後長什麼樣,也要知道中間怎麼發生。
像第一段提示詞,我不是只要求盤子上出現「滷霸」,而是安排湯勺傾斜、滷汁落下、先寫「滷」、再完成「霸」。
第二段則指定小籠包從蒸籠跳出,以 stop motion 逐格動畫的方式移動,最後才排列成完整的 TAIWAN。
有形成過程,影片才不會像突然變魔術一樣硬切出結果。
3. 先替文字保留構圖空間
如果畫面一開始就塞滿食物、餐具與裝飾,AI 到後面根本找不到地方放字。
因此第一段特別指定「盤緣留有大片乾淨留白」,第二段則讓鏡頭先帶到「桌面中央的空白區域」。
這個小細節非常重要。想讓 AI 排字,前面就要先替它留位置。
4. 同時寫出「要什麼」與「不要什麼」
只寫正面要求還不夠。這類影片常見的錯誤包括:食物黏成一整塊、文字變成普通字型、出現多餘招牌、Logo 或亂碼。
所以提示詞裡要直接限制:
- 不要套用現成字體
- 不要出現其他文字
- 不要 Logo、浮水印
- 每顆小籠包保持獨立
- 不要融合成實心字
- 畫面只能出現指定文字
限制寫得越具體,AI 越知道哪些畫面不能亂補。
5. 把 10 秒拆成明確節奏
我會把 10 秒拆成五段,每兩秒只處理一件事:
- 建立食慾與場景
- 交代環境與構圖
- 開始形成文字
- 完成文字
- 英雄鏡頭收尾
這樣做的好處,是模型比較不會把所有動作一次擠在前兩秒,也能讓最後的成果保留足夠時間被看清楚。
第一段:讓滷汁在白瓷盤上寫出「滷霸」
【影片一插入位置】
這段的核心不是控肉飯本身,而是把餐廳常見的醬汁擺盤,變成品牌文字動畫。
為了避免「滷霸」變成後製字卡,提示詞裡反覆強調:文字必須直接由滷汁畫在白瓷盤上,具有流動、暈染與琥珀色光澤,而且不能像印刷字體。
完整提示詞
滷霸10秒廣告腳本 風格:濃郁、有食慾、精緻擺盤感,如米其林等級美食廣告 色調:白瓷盤、琥珀滷汁色、米白飯色、淡金蒸氣光 場景:白瓷圓盤,中央控肉飯(白飯、滷五花、滷蛋、酸菜、蔥花),盤緣留白處待寫字 禁止:人物正臉、其他文字、其他 Logo、浮水印、套用現成字體 文字原則:「滷霸」二字直接以滷汁畫在白瓷盤留白處,如主廚醬汁擺盤線條,筆觸自然流動、邊緣微暈,不是印刷字體 0–2 秒|美味開場 極近特寫。湯勺舀起一塊油亮控肉,滷汁緩緩牽絲滴落,肉質軟嫩、油花分明,蒸氣從碗中升起,建立「剛起鍋」的食慾感。 2–4 秒|上桌全景 鏡頭拉開成俯拍,完整呈現白瓷盤上的控肉飯:白飯吸附滷汁泛光澤,滷蛋對切蛋黃濕潤,酸菜、蔥花點綴,盤緣留有大片乾淨留白,蒸氣繚繞。 4–6 秒|主廚收尾運筆 湯勺傾斜,滷汁如畫筆般落在盤緣留白處,流動筆觸開始勾勒「滷」字筆畫,邊緣自然暈染在白瓷上,光澤分明,蒸氣從筆畫上方輕輕飄過。 6–8 秒|霸字完成 鏡頭微俯緩慢推近,滷汁繼續寫出「霸」字,筆觸力道自然不規則,如主廚多年功夫一氣呵成,「滷霸」完整呈現在盤緣。 8–10 秒|英雄收尾 鏡頭從俯拍緩緩降至 45 度角,白瓷盤完整入鏡:中央熱騰騰控肉飯,盤緣「滷霸」醬汁字泛著琥珀光澤,蒸氣裊裊,畫面定格成高質感品牌主視覺。
這段提示詞可以怎麼改?
你可以保留原本的鏡頭結構,只替換品牌與材質:
- 牛排醬汁在盤面寫出餐廳名稱
- 巧克力醬在甜點旁寫出新品名稱
- 拿鐵奶泡慢慢形成咖啡品牌縮寫
- 辣油流過白瓷盤,畫出活動標語
但中文建議先從 2~4 個字開始。字數太多,不只容易寫錯,畫面也會變得太擠。
第二段:讓一顆顆小籠包排列成「TAIWAN」
【影片二插入位置】
這段使用的是另一種文字玩法:不是「寫字」,而是讓物件本身成為字的筆畫。
最容易失敗的地方,是 AI 把小籠包融合成一個白色實心字,或只在畫面上疊出普通的 TAIWAN 字型。因此提示詞裡多次強調:每顆小籠包都要獨立、彼此保留空隙,並且能看見完整的摺痕、陰影與形狀。
完整提示詞
製作一支 10 秒高質感小籠包廣告短片,風格像台灣觀光宣傳片結合精品食物廣告。 圖片為小籠包排列成 TAIWAN 的樣子。 畫面主題是「TAIWAN」。 最後要由一顆顆小籠包排列成清楚可讀的英文字「TAIWAN」。 整體風格: 溫暖、高級、乾淨、有台灣美食文化感。 畫面要像高質感旅遊美食廣告,不是普通餐廳菜單照。 色調為溫暖木色、竹蒸籠色、奶油白、淡金色蒸氣光。 不要人物,不要多餘文字,不要 Logo,不要浮水印。 場景: 淺色木桌,上面有竹蒸籠、小籠包、薑絲、醬油碟、湯匙、柔和蒸氣。 畫面乾淨,有留白,主角是小籠包排成的字。 第 0 到 2 秒|蒸氣開場 極近特寫。 竹蒸籠蓋子微微打開,白色蒸氣湧出。 鏡頭慢慢推近,看到一顆顆飽滿小籠包,皮薄、摺痕細緻、表面微微透光。 畫面要有剛出籠、熱騰騰、很香的感覺。 第 2 到 4 秒|台灣味建立 鏡頭低角度沿著木桌滑動,掠過薑絲、醬油碟、湯匙、竹蒸籠邊緣。 蒸氣在畫面中流動,形成溫暖的台灣早餐店與觀光美食氛圍。 鏡頭帶到桌面中央的空白區域,準備排字。 第 4 到 6 秒|小籠包開始排列 鏡頭抬升成微俯拍。 一顆顆小籠包從竹蒸籠中輕輕跳出來,像 stop motion 逐格動畫一樣移動。 每顆小籠包都保持獨立,彼此之間有清楚空隙,不要黏在一起。 小籠包開始一顆一顆排列成英文字母的輪廓。 第 6 到 8 秒|TAIWAN 成形 鏡頭變成俯拍,慢慢拉高。 小籠包逐格排列成完整大字「TAIWAN」。 字母要清楚可讀,但不要太制式,像手工用小籠包排列出來的字。 每一顆小籠包都要看得到完整形狀、摺痕、陰影與間距。 不要把小籠包融合成實心字,不要變成普通字型。 第 8 到 10 秒|英雄收尾 鏡頭從俯拍慢慢推近到 45 度英雄角度。 「TAIWAN」由一顆顆小籠包完整排好,蒸氣從字母縫隙間升起。 旁邊有竹蒸籠、薑絲、醬油碟自然點綴。 最後定格成一張高質感台灣美食宣傳主視覺。 文字要求: 畫面只能出現「TAIWAN」。 「TAIWAN」必須完全由一顆顆獨立小籠包排列而成。 每顆小籠包要分開、有空隙、清楚可見。 字要可讀,但帶一點自然不規則感,像手工排出來,不要像制式字體。 不要出現其他文字、中文、招牌字、Logo 或浮水印。 畫面目標: 讓人一看就想到台灣美食、熱騰騰的小籠包、觀光宣傳片。 整體要溫暖、高級、有食慾、有文化感。
這種「物件排字」還能怎麼玩?
同一個結構可以替換成很多題材:
- 珍珠排列成「TAIWAN」或飲料品牌名稱
- 蛋黃酥排列成「中秋」
- 咖啡豆排列成「COFFEE」
- 花瓣排列成婚禮新人縮寫
- 商品本體排列成活動折扣數字
- 城市車流在夜晚形成品牌 Logo 輪廓
建議先使用短英文、數字或簡單中文字測試。物件越大、文字越長,AI 越難同時兼顧可讀性與物件細節。
實際生成時,最常遇到的 5 個問題
問題一:文字打錯或多一筆
先重新生成 2~3 次。如果同一個字持續錯誤,就直接換成同音字、縮短文案,或改用英文與品牌縮寫。
不要為了一個模型目前不擅長的字無限重抽,真的很燒次數。
問題二:文字突然憑空出現
把形成過程寫得更具體,例如「滷汁從湯勺連續流下,依照筆畫順序完成文字」,或「物件每次只移動一小段,以逐格動畫方式排成字母」。
問題三:AI 偷偷套用普通字體
補上:
文字必須完全由指定材質構成,不是字幕、不是後製文字、不是印刷字體,不可在畫面上疊加一般文字。
問題四:排字物件全部黏在一起
除了寫「保持獨立」,還要加入可被看見的視覺條件:每個物件之間保留明顯空隙、各自擁有完整輪廓、接觸陰影與細節。
問題五:畫面自己長出招牌、Logo 或亂碼
在提示詞前段與最後的文字要求都限制一次:畫面只能出現指定文字,不要其他文字、招牌、Logo 或浮水印。
重複不一定漂亮,但在 AI 影片提示詞裡,有時候就是有用。
一個可以直接套用的萬用結構
想自己設計同類型影片,可以先照下面的骨架改:
製作一支 10 秒高質感[產品/食物]廣告短片。 場景為[環境與主要物件],整體色調為[色彩與光線]。 畫面最後出現「[指定文字]」。 文字必須完全由[指定材質或物件]構成,不是字幕、不是普通字體,也不是後製疊字。 0–2 秒:以特寫建立產品質感與氛圍。 2–4 秒:鏡頭拉開,呈現完整場景,並替文字保留乾淨空間。 4–6 秒:[材質/物件]開始依照筆畫或字母輪廓移動。 6–8 秒:完整形成「[指定文字]」,文字清楚可讀。 8–10 秒:以俯拍或 45 度英雄角度呈現最終主視覺並定格。 文字要求: 畫面只能出現「[指定文字]」。 文字必須完全由[指定材質或物件]形成。 不要其他文字、Logo、招牌或浮水印。 不要使用現成字體,不要把物件融合成實心文字。
你不一定要把提示詞寫得跟我一樣長,但「材質、形成方式、構圖空間、時間節奏、禁止事項」這五個部分最好都要有。
最後
Gemini 目前生成文字仍然會出錯,但它已經不只是把字硬塞進影片而已。只要換個方式描述,文字可以變成食物、醬汁、物件與場景的一部分,做出來的畫面也會比普通字幕更有記憶點。
這次的兩組提示詞都免費公開,可以直接拿去測試、改成自己的版本。
如果生成失敗,也不用急著懷疑自己。有時候不是你不會寫,是 AI 今天真的在亂打字,換個字反而比較快。
之後我也會繼續分享更多 AI 影片、文字動畫與實際應用的提示詞玩法。