4 秒的影片,一句話就能講完;但 15 秒的影片如果只給一句話,模型會把整段塞滿同一個動作,或自由發揮到失控。解法很簡單:像分鏡表一樣,按秒數切段落。
公式
10 秒以上的影片,建議拆成 3–4 段,每段交代那幾秒發生什麼、鏡頭怎麼動:
TIME-SEGMENTED
0-3s: 開場——場景、運鏡、動作
3-6s: 中段發展
6-10s: 高潮或關鍵動作
10-15s: 收尾、定格、品牌/文字浮現實例:一支咖啡廣告的 15 秒
PROMPT
0-5s: light and shadow slide across a wooden table and cup through venetian blinds, branches swaying gently.
6-10s: a coffee bean drifts down from the top of frame; camera pushes in until the screen goes black.
11-15s: text fades in — "Lucky Coffee" / "Breakfast" / "AM 7:00-10:00".每一段都是一個微小、可信的事件。節奏由你決定,而不是碰運氣。
延長影片時,時長要對齊
若你要「延長既有影片 5 秒」,生成時長就選 5 秒,不要選 15 秒——時長要對齊你描述的內容長度,否則模型會把 5 秒的內容硬撐或壓縮。
節奏的兩個原則
- 別在 4–5 秒裡塞太多場景。物理上合理的動作量,才生得好看。
- 前 3 秒是鉤子。尤其是廣告與社群短片,開場沒抓住人,後面再精緻也沒用。
想把「前 3 秒鉤子」這件事做到位,接著看〈廣告六要素〉怎麼把賣點變成開場就抓眼球的畫面。
動手做做看
把這篇的思路,直接拿去生成一支影片。
