模型永遠會生出「最有可能」的畫面,不是「你腦中那張」。多數人只顧著把正向提示詞寫好,卻把最省事的一個工具晾在旁邊:反向提示詞——直接告訴模型「這些東西不准出現」。用對了,能少重生好幾次;用錯了,只是貼一份萬用清單自我安慰。這篇把它拆開講清楚。
反向提示詞到底在做什麼
反向提示詞不是「反著寫一次正向提示詞」,而是一個獨立的排除清單:在取樣時,把你點名的概念從結果空間裡往外推。在這個平台上,它是圖片生成專屬的參數 --negative,填法很直接——--negative 後面接一串用逗號分開的詞,例如 blurry, extra fingers, text watermark。它管的是「不要出現什麼」,管不到「該出現什麼」;後者永遠是正向提示詞(七段式)的工作。
什麼時候它真的有效
- 正向提示詞已經寫得夠精準,但同一個瑕疵反覆出現——例如七段式都填滿了,手部特寫還是連續兩三次跑出多餘手指,這種「重複出現的具體症狀」最適合寫進
--negative精準排除。 - 模型的預設偏好跟你要的不一樣——例如你要照片級寫實,模型卻習慣性往插畫、CG 感偏,加上
cartoon, illustration, cgi能把結果往回拉正。 - 商業用途有硬性規格——電商圖、廣告素材不能有浮水印、不明文字、別人的商標,這類「絕對不能出現」的項目,直接寫進反向提示詞比事後裁圖修圖省事得多。
什麼時候它只是在幫爛掉的正向提示詞擦屁股
反向提示詞最常被誤用成「補救措施」:正向提示詞根本沒寫 camera 或 quality,結果一片模糊,於是在 --negative 塞進 blurry, low quality 想蓋過去。這種做法效果有限——模型連你要拍什麼焦段、什麼景別都不知道,加再多「不要模糊」也救不回一句話交代不清的正向提示詞。
很多人習慣不管這次生成什麼,都貼上同一份「業界公認」的長長反向提示詞清單。兩個壞處:清單越長,每個詞被模型『聽見』的力道越稀薄;清單裡的詞還可能誤傷你這次其實想要的東西——例如生成商品包裝特寫時,通用清單裡的 text 反而會跟包裝上該有的文字打架。反向提示詞該是針對這次生成、觀察後才加的工具,不是預設的防護罩。
| 遇到的狀況 | 先看正向提示詞的哪一段 | 反向提示詞能不能救 |
|---|---|---|
| 畫面模糊、沒對焦 | 補 camera(焦段、光圈)與 quality(sharp focus, high detail) | 只能小幅輔助,治不了根本沒寫清楚的正向提示詞 |
| 手指、肢體變形 | 先確認 action/camera 沒有把手部塞進極端角度或過近特寫 | 能,這是反向提示詞最擅長的場景 |
| 背景冒出奇怪文字/浮水印 | env/style 避免暗示招牌、報紙等會生文字的場景 | 能,直接排除 watermark, text, logo |
| 想要照片級卻長得像插畫 | style 段寫更精準(photorealistic, 35mm, film grain) | 能當保險,但正向的精準度才是主力 |
分類詞彙表:四大類地雷詞
與其每次憑印象亂湊,不如按類別記。以下四類涵蓋了圖片生成最常見的失敗模式:
| 類別 | 常見詞彙 | 什麼時候該用 |
|---|---|---|
| 解剖/畸形 | distorted hands、extra fingers、fused fingers、missing fingers、extra limbs、deformed face、asymmetrical eyes、mutated body | 人像、手部特寫、多人合照、複雜姿勢時最容易出現,是最值得優先寫的一類 |
| 算圖瑕疵 | blurry、out of focus、low resolution、noisy、jpeg artifacts、oversharpened、banding、warped geometry | 商業用素材需要乾淨銳利時;先確認正向的 quality 段有沒有寫,反向只是保險 |
| 不想要的文字/浮水印/商標 | watermark、signature、logo、caption、username、stock photo text | 電商圖、社群素材最忌諱背景莫名冒出文字或別人的商標;但畫面本來就需要文字(如包裝標籤)時要拿掉 text,避免誤傷 |
| 風格外洩 | cartoon、anime、illustration、3d render、cgi、painting、plastic skin、doll-like | 想要照片級寫實卻被模型的預設偏好拉走時,尤其在 style 段寫得不夠精準時最常見 |
清單越長,每個詞被模型『聽見』的力道越稀薄,效果不增反減,還可能誤刪你想要的東西。與其貼一份三十個詞的萬用清單,不如針對這次生成觀察到的兩三個具體問題精準下手。
影片呢?排除規則搬到了專案層
影片這邊的位置不一樣:單次生成影片時,沒有一個「這次不要什麼」的欄位可以填。但平台不是沒有這個機制——它被搬到專案層了。在專案的製作聖經側欄,有一個「影片預設提示」,填進去的話會自動套用到這個專案底下每一顆影片鏡頭;官方給的範例就是最典型的用法:影片中不要有文字。
如果你在做短影集,還有一層「本集預設提示」——它會疊加在專案預設之上,只作用在這一集的鏡頭。所以排除規則的分工是:專案層放整部片都適用的(不要文字、不要 logo),劇集層放只有這一集要的。設定一次,之後每顆鏡頭生成都自動帶著走,不用每次重打。
這是兩者最大的差別:圖片的反向提示詞是逐次生成的參數,這次填了只影響這次;影片的排除規則是專案/劇集層的常駐設定,設定一次、全專案生效。想針對單一鏡頭排除某個東西,影片這邊沒有對應的欄位——要嘛寫進專案預設(但會影響所有鏡頭),要嘛用下面說的正向描述去預防。
而且有一整類影片瑕疵,本來就不是排除詞救得了的:閃爍、肢體變形游移、畫面扭曲、鬼影、節奏忽快忽慢——這些往往不是「模型畫錯了什麼」,而是「你沒說清楚東西該怎麼動」。這類問題的解法要壓回正向描述:節奏寫清楚「calm and steady, no cuts」而不是留白讓模型自由發揮;動作要具體描述動作本身而不是一個靜態姿勢——「站在原地」很容易讓模型自己補上奇怪的小動作填滿時間;運鏡與主體動作要互相搭配,一個快速甩鏡配一個靜止不動的主體,兩邊互打架,這種混亂常被模型解讀成「這裡要有變化」,於是生出你不想要的變形。
換句話說:「不要出現什麼」(文字、logo)交給專案預設提示;「動起來不要壞掉」則要靠正向描述的精確度預防,排除詞幫不上忙。
跟七段式提示詞搭配:一個實例
設定情境:商品手持特寫,前兩次生成手指都出現變形。先把七段式攤開檢查一遍:
[Subject] A woman in her mid-20s presenting a skincare bottle to camera
[Action] holding the bottle at chest height, thumb resting on the cap, gently turning to show the label
[Environment] minimalist studio, soft grey seamless backdrop
[Lighting] soft key light from upper left, gentle fill, no harsh shadows
[Camera] close-up, shallow depth of field, 85mm
[Style] clean commercial product photography, photorealistic
[Quality] 2K, sharp focus on hand and label, high detail七段都填滿了,手指還是崩壞——這時候才輪到反向提示詞針對性補刀,而不是回頭亂改正向提示詞:
distorted hand, extra fingers, fused fingers, missing fingers, deformed nails, extra limbs, blurry label text, watermark, cartoon, illustration, plastic skin建議的疊代流程
- 先把七段式填滿,尤其 `quality` 和 `camera`——多數瑕疵其實是正向描述不夠精準造成的,先把這層做滿。
- 生成 2–3 次基準版本,觀察真的重複出現的瑕疵——不要看一次就下結論,也不要幫還沒發生的問題預先加詞。
- 只把「重複出現」的瑕疵寫進 `--negative`——針對這次生成觀察到的問題,不要複製別人的萬用清單。
- 一次只加 1–2 個新詞測試,確認沒有連帶刪掉你想要的細節(例如加
text卻連包裝上該有的文字也一起被排除)。 - 定案後把這組 `--negative` 存起來,同系列鏡頭重複使用,維持整組素材的一致性。
如果同一個角色換了一顆鏡頭就跑掉臉、反向提示詞怎麼調整都留不住——那通常已經不是提示詞層級能解的問題。反向提示詞留給重複出現的瑕疵,身份一致性交給參考圖去鎖,那是《角色一致性》要處理的地盤。
