SeedStar · 學院
教學指南

常見失誤診斷室:畫面崩壞、動作卡頓、角色換臉,怎麼修

生成結果不對勁的時候,多重生幾次不一定有用。這篇是一張症狀對照表——先找到真正的原因,再對症下藥。

常見失誤診斷室:畫面崩壞、動作卡頓、角色換臉,怎麼修

生成結果不理想的時候,最直覺的反應是「再生一次」。但如果原因出在提示詞的寫法,重生十次也只是重複同一個錯誤十次。這篇整理平台上最常見的幾種失誤症狀,先幫你找到真正的原因,再告訴你怎麼修。

先看這張對照表

症狀常見原因怎麼修
主體幾乎不動,像一張照片動作描述寫成了「狀態」而不是「動作」改成動詞開頭的具體動作
動作混亂、畫面扭曲變形鏡頭運動跟主體動作互相打架,或塞太多動作在太短時間一顆鏡頭一個主意;動作減量,或拉長時長
同一個角色,換一顆鏡頭就變臉、換裝靠文字描述硬撐角色一致性用參考圖在圖片層先鎖住角色,再拿關鍵幀去生動畫
送出後直接出錯,訊息像是欄位衝突同時用了兩種互斥的視覺輸入模式第一幀模式和參考圖模式只能擇一
用真人照片生成直接失敗內容安全/人臉政策擋下平台部分情況會自動去識別化重試;不行就換成生成或風格化的參考圖
參考影片效果很怪,或直接被拒絕參考影片的畫面解析度太低換一段更大、更清楚的參考影片來源
影片生成直接報錯動作欄位是空的影片一定要有非空的動作描述,哪怕只有一句話

動作像照片:把「狀態」改寫成「動作」

這是最常見的落雷。「站在田野裡」是一個狀態,模型不知道要做什麼;「涉水穿過及腰的草叢,草桿隨著腳步彎折」是一個動作,有明確的起訖與過程。判斷方法很簡單:你寫的那句話,能不能拍成一張靜態照片?如果可以,它就是狀態,不是動作。

寫成狀態(容易變照片)改寫成動作
stands in a fieldwades forward through tall grass, stalks bending
sits at a deskleans forward and starts typing, shoulders tensing
a cup on the tablesteam slowly rises from the cup, curling upward

動作混亂:鏡頭跟主體只能有一個在「搶戲」

「鏡頭快速橫搖」加上「主體同時原地不動」——這兩句話彼此矛盾,模型只能亂猜怎麼調和,結果通常是扭曲變形。同樣的問題也發生在「塞太多動作到太短的時長」:3 秒內要主體轉身、揮手、又要鏡頭環繞一圈,資訊量超過畫面能承受的範圍。

  • 一顆鏡頭,一個運鏡主意:不要同時要求「靜止」又要「環繞」
  • 動作別塞太滿:想放進兩個以上的動作,先確認時長是否足夠,或改用時間分段法拆開
  • 時長不夠就加時長:比起硬塞進 3 秒,拉到 6 秒往往比較穩定

角色換臉:把一致性交給圖片層,不要靠文字硬撐

文字描述留不住一張臉

「同一個 20 歲女生,黑色長髮」這種文字描述,在多次生成之間會自然漂移——模型沒有記憶,每次都是重新想像一次。真正穩定的做法是用參考圖在圖片層先鎖住角色,再拿那張關鍵幀去生成動畫,細節見〈角色一致性〉。

模式衝突與真人照片:兩個容易踩的平台限制

視覺輸入模式互斥:第一幀模式(直接指定影片開始的畫面)跟參考圖模式(用圖片當風格/角色參考)目前只能擇一,同時使用會直接被擋下。送出前先確認自己要的是哪一種。

真人照片的人臉政策:上傳真實人物照片生成時,有些情況會直接失敗——這是內容安全機制在保護當事人肖像權,不是平台故障。部分場景平台會自動做去識別化處理再重試;如果還是失敗,改用生成或風格化過的參考圖會更穩定。

參考影片很怪:解析度是最容易被忽略的變數

拿一段畫質很差、解析度過低的影片當參考,平台會自動把它的像素「墊高」到可用的下限——但這個補償是有極限的,來源畫質太差,結果通常也不會理想。換一段更清楚、解析度更高的參考影片來源,往往比調整提示詞措辭更有效。

一次只改一個變數

生成結果不對的時候,不要同時改運鏡、動作、時長、參考圖——一次只調整一個變數再重生,才看得出來是哪個改動真正解決了問題。這比「整句重寫再賭一次」有效率得多。

把這張對照表存起來,下次卡關的時候先對一遍——很多時候答案已經在表格裡了。

SSteven Lai影像導演 · 範本創作者查看所有文章
瀏覽其他分類