立即訂閱享受30%折扣!解鎖無限AI影片生成。領取優惠
我們打造了更好用的 AI 圖片編輯與生成產品:PicEnhancer,多數功能免費使用。立即體驗

如何讓同一個角色在多段 AI 影片中保持一致

Long Cheng
善用角色設定表、參考圖片、種子碼與分鏡規劃,讓同一個角色的長相、服裝與聲音在多段 AI 影片之間維持一致,不再每段都換了一個人。
如何讓同一個角色在多段 AI 影片中保持一致
how-to
characters
prompts
veo4

第一段影片看起來很棒。偵探穿著灰色風衣,一頭深色短髮,一邊眉毛上有道疤。接著你生成第二段,風衣變成了咖啡色,頭髮變長了,疤也不見了。到了第五段,你手上已經有五個不同的人,只是剛好都在當偵探。

每一次生成都是從零開始。模型不會記得上一段影片,所以凡是你沒有寫死的細節,它都會重新發明一次。解決方法就是盡可能把細節固定下來:用文字、用圖片,在支援的模型上再加上種子碼。本篇會依照建議的使用順序,逐一介紹每種方法。


為什麼角色會在片段之間跑掉

AI 影片模型會讀取你的提示詞,然後用自己的最佳猜測填補每一個空白。「一位穿著夾克的年輕女性」留下了幾十個空白:她的年齡、臉型、髮型、夾克的顏色與剪裁、照在她皮膚上的光線。每次重新生成,這些空白都會被填上不同的答案。

所以,維持一致性的關鍵主要在於填補空白。你留給模型自由發揮的選項越少,它能改變角色的空間就越小。能用來達成這件事的工具有三種:

  1. 文字:一段固定的角色描述,每次都一字不改地重複使用。
  2. 圖片:一張參考畫面,讓模型直接看到角色長什麼樣子。
  3. 種子碼:在支援的模型上,用一個數字重現模型的隨機起點。

能三種都用,就三種都用。


步驟一:寫一份角色設定表

在生成任何東西之前,先寫一份簡短的角色設定表。這是一段用固定、具體的詞彙描述角色的文字,你會原封不動地貼進每一則提示詞裡。

一份好的角色設定表涵蓋四個面向。

臉部與身形

年齡範圍、臉型、膚色、瞳色、髮色、頭髮長度、髮型、體型,再加上一兩個明顯的特徵。一道疤、一片雀斑,或是一副圓形銀框眼鏡,都能給模型一個具體的細節去重複,也讓你一眼就能看出角色有沒有跑掉。

服裝

寫出每一件單品的名稱、顏色與材質。「芥末黃羊毛毛帽、帶黃銅鈕扣的海軍藍帆布工作外套、白色 T 恤」遠比「休閒服裝」穩定得多。

聲音與舉止

如果你生成的影片帶有音訊,就要描述聲音:音高、語速、口音與情緒。「沉穩低沉、略帶沙啞的嗓音,說話很慢」能讓每段影片都朝同一個目標生成。如果你打算在後製時再配音,就把這部分從影片提示詞中拿掉。

風格

角色所在世界的視覺樣貌:寫實、3D 動畫、日式動畫、底片顆粒、調色風格。換了風格的角色,看起來就會像另一個人。

角色設定表範例

MAYA: a woman in her early thirties with an oval face, warm brown skin, dark brown eyes, and shoulder-length black curly hair tied back with a red scrunchie. Small gold hoop earrings. Thin silver scar across her left eyebrow. She wears a mustard-yellow wool beanie, a navy canvas work jacket with brass buttons, and a plain white t-shirt. Calm, low voice with a slight rasp; she speaks slowly and smiles with one side of her mouth. Realistic cinematic style, soft natural light, gentle film grain.

(範例中文說明:三十出頭的女性 Maya,鵝蛋臉、溫暖的棕色皮膚、深棕色眼睛,及肩黑色捲髮用紅色髮圈綁起,戴小金圈耳環,左眉有一道細細的銀色疤痕;戴芥末黃羊毛毛帽,穿帶黃銅鈕扣的海軍藍帆布工作外套與素白 T 恤;嗓音沉穩低沉、略帶沙啞;寫實電影風格、柔和自然光、輕微底片顆粒。提示詞本身建議保留英文,AI 影片模型對英文的理解最好。)

設定表請控制在一小段的長度,就像上面的範例。太單薄的設定表會留下空白;太長的設定表則會讓關鍵細節淹沒在場景描述裡。


步驟二:一字不差地重複使用

寫好設定表之後,最常見的錯誤就是改寫它。你在第一段寫「mustard-yellow beanie」,第二段卻寫成「yellow knit hat」。對你來說兩者是同一件東西;對模型來說,卻是兩則不同的提示詞,會產生兩種不同的結果。

重複使用的原則:

  • 直接複製貼上設定表。 不要憑記憶重新打一次。
  • 維持相同順序。 每一則提示詞都把角色設定表放在最前面,再接著寫場景與動作。
  • 只改場景。 地點、動作與運鏡會隨每段影片改變,角色描述則一個字都不動。

重複使用設定表的提示詞範例

MAYA: a woman in her early thirties with an oval face, warm brown skin, dark brown eyes, and shoulder-length black curly hair tied back with a red scrunchie. Small gold hoop earrings. Thin silver scar across her left eyebrow. She wears a mustard-yellow wool beanie, a navy canvas work jacket with brass buttons, and a plain white t-shirt. Realistic cinematic style, soft natural light, gentle film grain.
Scene: Maya stands at a food truck window on a rainy evening and hands a paper cup of coffee to a customer. Medium shot, slow push in. She says, "Careful, it's hot." Rain on the metal roof, quiet street ambience.
MAYA: (same sheet, pasted word for word)
Scene: Early morning. Maya unlocks the side door of the food truck and steps inside, switching on a string of warm lights. Wide shot from across the street, camera static. No dialogue. Birds and distant traffic.

第一則:雨夜裡,Maya 在餐車窗口把一杯紙杯咖啡遞給客人,中景、緩慢推近,她說「小心燙」。第二則:清晨,Maya 打開餐車側門走進去,點亮一串暖色燈泡,從對街拍攝的全景、固定鏡頭。

在你實際的提示詞中,請把「same sheet」換成完整的設定表。上面的佔位文字只是為了節省本文篇幅。


步驟三:用參考圖片鎖定外觀

參考圖片是比文字更強的錨點,因為模型可以直接看到那張臉,而不必靠想像。

操作流程:

  1. 製作一張主視覺圖:用圖像工具生成角色,或使用你擁有使用權的照片。挑一張清楚、正面、光線均勻,臉部與服裝都完整入鏡的畫面。
  2. 在每段影片的圖生影片中,把它當作第一幀。 在 veo4.dev 上,Veo 4 的選填參考圖片會成為影片的開場畫面。Kling 3.0、Seedance 2.0 與 Wan 2.6 都接受選填的第一幀,而 Wan AI 2.2 則一定要從你提供的圖片開始生成。
  3. 提示詞裡還是要放角色設定表。 圖片固定的是第一幀,文字則讓角色在影片逐漸離開那一幀時依然保持穩定。

首幀與尾幀

有些模型同時接受首幀與尾幀。在 veo4.dev 上,Veo 3.1 與 MiniMax H3 都有這兩個欄位。這對一致性非常有幫助,因為模型必須停在你指定的畫面上。如果兩張圖都是同一個角色,這段影片就有了兩個錨點,而不是一個。

一個實用小技巧:把你滿意的影片最後一幀存下來,當作下一段影片的第一幀。這樣角色就能從一個鏡頭延續到下一個鏡頭。

準備一個小小的參考圖庫:正面、四分之三側面,以及全身各一張。每拍一個新鏡頭,就挑最接近的那張來用,並讓圖片的長寬比與影片一致,避免臉被裁掉。

想了解更多圖生影片的選項,請參考圖生影片頁面。


步驟四:在支援的模型上使用種子碼

種子碼是模型用來當作隨機起點的數字。在支援種子碼的模型上,只要提示詞、設定與種子碼都相同,就會得到非常相近的結果。

在 veo4.dev 上,Happy Horse 1.0 與 Wan AI 2.2 會實際使用你填入的種子碼。這個欄位位於進階設定中。

用種子碼維持一致性的方法:

  1. 用隨機種子碼生成幾個版本。
  2. 找出角色看起來最對的那一版,記下它的種子碼。
  3. 接下來的影片沿用同一個種子碼,只修改提示詞中的場景部分。

種子碼最適合用在小幅變化上:同一個角色、同一個地點,換一個動作或角度。如果場景文字改動很大,即使種子碼相同,結果也會差很多。在其他模型上,請依靠角色設定表與參考圖片。


步驟五:規劃能掩飾小差異的鏡頭

即使用上了以上所有方法,還是可能出現些微的偏移。好的分鏡規劃能讓這些偏移難以被察覺。

  • 變化景別。 從全景切到特寫,能掩飾服裝上的小變化,因為觀眾本來就預期畫面會改變。
  • 維持相同光線。 同一張臉,在溫暖的夕陽光下和冰冷的辦公室燈光下,看起來就像兩個人。
  • 每段影片只安排一個動作。 動作越複雜,畫面動態就越多,臉在影片中途變形的機會也越大。
  • 善用細節鏡頭。 一隻握著杯子的手,或是一個背影,就能推進故事,又不必再拍一次臉。
  • 生成前先規劃順序。 寫一份簡短的分鏡表:鏡頭編號、景別、動作、台詞,以及用來錨定該鏡頭的圖片。然後依照這個順序生成。

分鏡表範例

鏡頭景別動作錨點
1全景Maya 在清晨打開餐車主視覺圖作為第一幀
2中景Maya 在櫃台後煮咖啡鏡頭 1 的最後一幀
3特寫Maya 微笑並說出台詞正面參考圖
4細節雙手把杯子遞給客人僅用文字設定表

一致性檢查清單

在系列影片的每一次生成前,逐項確認:

  • 角色設定表一字不差地貼在提示詞開頭。
  • 每件服裝都寫明了顏色與材質。
  • 角色至少有一個明顯的特徵。
  • 視覺風格與光線和先前的影片一致。
  • 在模型支援的情況下,已附上參考圖片或上一段影片的最後一幀。
  • 模型、長寬比與解析度和系列中其他影片相同。
  • 在支援種子碼的模型上,沿用了同一個種子碼。
  • 每段影片都只有一個清楚的動作。

常見問題

我能讓每一段影片中的角色都完全一模一樣嗎?

沒辦法每次都做到,因為生成過程本身帶有一定的隨機性。固定的設定表加上參考圖片,能大幅縮小差異。建議多生成幾個版本,再留下符合的那幾段。

參考圖片比文字描述更好嗎?

就臉部與服裝而言,參考圖片是更強的錨點。最好的做法是兩者並用:圖片固定外觀,文字則讓外觀在影片進行中保持穩定。

要怎麼讓聲音保持一致?

在每一則提示詞中用相同的方式描述聲音:音高、語速、口音與情緒。台詞盡量簡短。聲音沒有像參考圖片鎖定臉部那樣的錨點,所以請挑出聲音相符的版本,其餘重新生成。如果是長篇系列,自己錄音或在後製時配音,能讓你完全掌控。

如果一個場景裡有兩個以上的角色呢?

為每個角色分別寫一份設定表並取一個清楚的名字,讓每個人都有不同的明顯特徵與代表色。可以的話,讓他們在畫面中保持距離。兩個外型很相似的角色,很容易混在一起。


開始打造你的角色系列

寫好你的角色設定表,做出一張強而有力的主視覺圖,然後生成你的第一個鏡頭。你現在就可以在 AI 影片生成器中試試看,或直接前往 Veo 4 製作以圖片引導的影片。當你的系列準備擴大規模時,可以到定價頁面查看方案。

還打算拍更多片段嗎?閱讀運鏡提示詞指南來掌控每一個鏡頭,若影片出現偏移,也可以參考為什麼你的 AI 影片看起來不對勁找出修正方法。