SeedStar · 學院
教學指南

如何撰寫 Seedance 2.5 提示:從一行想法到 30 秒影片

Seedance 2.5 單次輸出拉長到 30 秒、支援 50 個參考素材,但提示詞的核心邏輯依然是:像寫分鏡表一樣下指令。

如何撰寫 Seedance 2.5 提示:從一行想法到 30 秒影片

Seedance 2.5 已於 2026 年 7 月 31 日正式上線,率先在 Jimeng AI 與 Doubao 專業版推出,後續將透過火山引擎開放 API。輸出長度從 15 秒翻倍到 30 秒,參考素材上限從十幾個拉到 50 個,編輯控制也更精細——但所有這些升級,其實都只獎勵同一種技能:像寫分鏡表一樣撰寫提示詞,讓每個參考檔案都各司其職。

對曾經學過 Seedance 2.0 的人來說,好消息是:核心語法幾乎沒有變。Seedance 2.5 保留了同樣的三種任務拆分(參考、編輯、延伸),改變的是你能「餵」給它的素材量,以及模型必須維持一致性的時間跨度。本篇指南將帶你一次看懂兩者。

重點摘要:Seedance 2.5 帶來了什麼?

  • 單次生成可達 30 秒,每個任務最多接受 50 個參考素材:30 張圖片、10 個影片片段、10 個音訊片段。
  • 核心提示詞結構繼承自 Seedance 2.0:定義主體 → 編寫編號鏡頭 → 用 {} 包裹對話 → 品質詞 + 約束詞收尾。
  • 編輯提示詞有一條嚴格規則:只有在「借用特徵」時才寫 reference @video1;若要修改該片段本身,直接命名影片,否則模型可能把你的編輯誤判為參考任務。
  • 截至 2026 年 7 月 31 日,Seedance 2.5 尚未在 Atlas Cloud 上架;目前 Atlas Cloud 上的 Seedance 2.0 系列已使用相同參考語法,價格約為每秒 0.09 美元(含當日生效的 20% 折扣)。

四項關鍵升級,改變提示詞寫法

對鍵盤操作者來說,Seedance 2.5 有四項升級最有感:

  • 輸出長度翻倍:從 15 秒拉長到 30 秒。
  • 參考上限三倍:從十幾個增至 50 個素材。
  • 編輯成為一級任務:擁有自己的語法,不再只是附屬功能。
  • 對話原生支援十幾種語言:不再只有中英兩語。
注意:「世界首創」是廠商說法

字節跳動宣稱 30 秒輸出與 50 個素材上限為「世界首創」,請將其視為行銷用語,而非業界既定標竿。真正影響輸出品質的是:燈光、運鏡、表演與情緒可讀性都有顯著提升,AI 痕跡也大幅減少。

無論如何,仍建議養成一個習慣:即便低於 30 秒上限,結構化的提示詞表現依然更佳。更長的畫布只會「放大」飄移,而非隱藏它。

現在就可以練習:在 Atlas Cloud 上使用 Seedance 提示詞

截至 7 月 31 日,Seedance 2.5 尚未登陸第三方平台,API 與火山引擎遊樂場預計於 2026 年 8 月 7 日全面開放。本週最務實的做法,是先在 Seedance 2.0 系列上演練完全相同的參考語法——@ 主體語法、參考槽位、編輯動詞,全部互通。

Seedance 2.0 系列已透過 Atlas Cloud 的 Seedance 模型家族提供,包含文字轉影片、圖片轉影片,以及多模態的參考轉影片遊樂場。定價採代幣制:

  • 參考端點 720p 輸出:每秒 0.2419 美元;若任務包含影片輸入,則降至每秒 0.1486 美元。
  • 文字轉影片卡片標價約每秒 0.112 美元,加上 2026 年 7 月 31 日生效的 20% 折扣後約為 0.09 美元/秒。
  • Seedance 2.0 Fast 折扣後約每秒 0.072 美元,輕量版 Mini 約為 0.045 美元。
折扣有時間限制

網站上的折扣設有倒數計時器,在為專案編列預算前,請先至模型頁面確認當前價格。

登入後開啟「參考轉影片遊樂場」,無需撰寫程式碼即可執行所有模式。在左側上傳參考檔案,然後在提示詞框中輸入 @,就能將主體綁定到特定的圖片、影片或音訊槽位。

頁面上的預設範例很值得當作模板閱讀——每個重要的名詞都與 @image 綁定,模型永遠不會猜錯你指的是哪個城市或哪個機器人。

  1. 取得 API 金鑰:在 Atlas Cloud 控制台中建立一個,然後複製它。
  2. 查閱 API 文件:端點、參數與驗證資訊都寫在文件中。
  3. 發出第一個請求:參考端點接受提示詞,以及每種參考類型的平行陣列。
範例:呼叫 Seedance 2.0 參考轉影片 API
curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \
  -d '{
    "model": "bytedance/seedance-2.0/reference-to-video",
    "prompt": "Define the woman in @image1 as Mara. Shot 1: medium tracking shot, Mara walks through the night market @image2, neon reflections on wet pavement. <sizzling from food stalls>",
    "reference_images": ["https://your-cdn/mara-face-closeup.jpg", "https://your-cdn/night-market.jpg"],
    "reference_videos": [],
    "reference_audios": [],
    "duration": -1,
    "resolution": "720p",
    "ratio": "16:9",
    "generate_audio": true
  }'

把 duration 設為 -1,可讓模型在此端點 4 到 15 秒的範圍內自行選擇自然長度。接著輪詢回傳的 prediction ID 直到完成:

輪詢生成結果
curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \
  -H "Authorization: Bearer $ATLASCLOUD_API_KEY"

完成的回應會包含託管影片的 URL。由於 Atlas Cloud 在整個平台上使用統一 API,未來 Seedance 2.5 推出後,你只需把模型字串換成新名稱,參考陣列、輪詢迴圈和提示詞檔案都能維持不變。

Seedance 2.5 提示詞公式(繼承自 2.0)

把模型想像成一位多模態導演:它讀取你的文字、圖片、影片和音訊,然後把任務拆成「空間層」(畫面中有什麼)與「時間層」(隨時間如何變化)。這對應到一個六槽公式,前兩個槽之後的內容皆為可選:

  • 主體 + 動作或事件 + 場景與環境 + 視覺風格 + 運鏡 + 聲音

Seedance 2.0 時代常用的燈光詞、品質詞、約束尾句(例如 no subtitles, no watermark)一樣可以塞進這些槽位,你之前學過的東西都不會浪費。

一條重要規則

生成設定(如時長、解析度)應完全排除在提示詞之外,它們屬於介面或 API 參數,不屬於文字提示的一部分。

六個槽位在實務上可以濃縮為四行可寫的內容。關鍵在於:主體永遠優先定義——在模型知道你要的是哪張臉之前,參考素材毫無用處。每個主體只要定義一次,附帶兩三個穩定特徵,之後就重複使用該標籤。

基礎範本
Define the woman in @image1 (red dress, straw hat) as Mara.
Mara walks along the pier at dusk...
// ...接續動作、場景、風格、運鏡、聲音
  • 為每個 @參考 賦予即時的任務描述,清楚說明模型應忽略的部分,例如:in the style of '@image1 for the potter's features, hair, and green apron, not the image background'。
  • 使用貼近臉部的特寫作為獨立圖片,與全身照分開——這是 Seedance 2.0 時代對抗身分飄移的經典技巧,現在依然有效。
  • 小心處理多角度:主體 ≤ 5 個時,單視角或多視角圖片皆可;超過 5 個時,最好堅持單視角,把角度分鏡圖拆成獨立圖片並明確宣告,例如:these four images define the same folding lamp; only one lamp appears in the video。

聲音和文字各自有專屬的包裝符號,避免模型把對話誤認為字幕:

  • 對話:使用 { },例如 She smiles and says {We can definitely do it}
  • 音樂:使用 ( ),例如 (upbeat rock plays in the background)
  • 音效:使用 < >
  • 螢幕字幕:使用 【 】,例如 【Chapter One: Departure】

將每句對話保持在單一語言中,並在花括號前標明語言。若要控制口音,可使用專屬模式:語言、地區變體、語氣、說話者,然後是台詞,例如:

口音控制範例
Dialogue language: natural, conversational American English.
The girl says: {I thought you weren't coming.}

50 個參考槽位怎麼用才對?

Seedance 2.5 的 50 個槽位分配為:30 張圖片 + 10 個影片片段 + 10 個音訊片段。影片和音訊的時間預算是分開計算的:最多 30 秒的影片參考,加上另外 30 秒的音訊參考,每個片段長度介於 2 到 30 秒之間。

  • 圖片:最高支援 4K、30 MB
  • 影片:最高支援 4K、200 MB
  • 音訊:15 MB 的 mp3 或 wav 格式
最糟的用法就是把 50 個槽全部填滿

槽位數量是 Seedance 2.0 的三倍、參考素材長度翻倍,但並不代表你應該一次塞好塞滿。素材越多,模型越容易混淆;重點在精準,不在數量。

  • 音訊或影片主體參考:控制在 5 個以下(複雜任務最多 6–10 個)
  • 主體圖片:控制在 8 張以下(最多 9–12 張)
  • 單個片段長度:以 5–10 秒為佳——少於 2 秒身分資訊不足;完整 30 秒則會稀釋你想複製的特徵

當素材開始堆積,建議的刪減順序是:核心角色 → 關鍵產品/道具 → 場景 → 整體風格。愈核心的東西,愈值得保留參考。

答案是:群體場景。一個旗艦展示案例是 30 秒的宮廷宴會,由 20 個編號的角色和道具圖片加上三個聲音樣本構成,每個賓客都與 @參考 綁定。多角色群體場景、武俠動作序列、把動作遷移到攀爬大猩猩身上——這類展示案例,都依賴大量堆疊的完整模態參考。

寫分鏡表,讓 30 秒提示詞保持連貫

最值得延續的單一習慣:停止撰寫氛圍文案,開始撰寫編號鏡頭。A man runs through the street, very cinematic 無法為時間層提供任何排程依據;分鏡表則可以:

分鏡表提示詞範例
Define the girl in @image1 as Lin. @image2 sets the dorm scene. Reference @video1 for camera movement.
Shot 1: medium tracking shot, early evening. Lin walks to the dorm door, pauses, takes a slow breath, slightly nervous. Warm light from the corridor window.
Shot 2: cut to interior medium shot. Lin pushes the door open. Roommates look up from their desks. One asks {So? Did you pass?}. Slow half-body cuts between faces.
Shot 3: close-up on Lin. She lowers her head, then breaks into a laugh and says {Got you all}. The roommates chase her around. Camera pulls back to a wide shot of the room.
Documentary realism, warm tones, soft light. Faces stay stable. No subtitles, no watermark.

每個鏡頭都回答同樣四個問題:

  • 運鏡:每個鏡頭從一個動作開始,使用標準術語,例如 slow push-in、fixed camera、cut to close-up
  • 動作:身體部位 + 速度或力度,例如 slowly raises a hand、grips the strap hard
  • 空間:主體現在的位置,例如 at the dorm door、crossing the rooftop
  • 音訊:此鏡頭的對話、音效或音樂,例如 {台詞}、<音效>、(音樂)
  • 量化動作:用 slowly、sharply、slightly 這類副詞,並指明是哪個部位在動。
  • 把情緒外化,而非標籤化:與其寫 she is sad,不如寫 head down, shoulders trembling slightly, fingers twisting the hem of her jacket——後者才能讓畫面活起來。

另外,Seedance 2.0 時代「每個鏡頭只能有一個運鏡動作」的限制已經放鬆。Seedance 2.5 可以處理組合動作,例如在一個運動員入場的長鏡頭中同時進行跟拍、起重機升降和旋轉,而且執行穩定。建議從簡單開始,當鏡頭值得時再做組合。

時機控制是 Seedance 2.5 與前代最大的不同。在 Seedance 2.0 中,精確到秒的提示常導致生成不穩定;這個限制在 2.5 已經消失——你現在可以全程使用時間碼,例如 [0-3s]、[3-5s]、[5-10s],或根據旁白逐秒編寫。

鏡頭順序依然承載故事,秒數範圍則讓你能夠精確定位某個節拍落在 30 秒內的哪個位置。

編輯提示詞:只改一件事,保留其餘

編輯是最考驗措辭的地方,因為一個動詞就決定了任務類型。規則很明確:

只有當你想把特徵「借用到新影片」時,才寫 reference @video1。當你想修改該片段本身時,直接命名它(@video1、strictly edit @video1),否則模型可能把你的任務誤判為參考任務,並重新生成整個場景。

好的編輯提示詞可以濃縮為三個動作:

  • 用 @video1 指向來源
  • 精確限定哪些部分要改(若更換主體,則加入參考圖片)
  • 最後以一條鎖定行結尾,例如 everything else stays unchanged,避免模型亂改你沒提到的部分

有兩個參數你無法控制:編輯後的片段會保留來源的寬高比與大約時長。延伸也會繼承寬高比,但增加的長度可以在提示詞中設定(例如 extend by 6 seconds)。

  • 添加:描述新元素、何時出現、何處出現 → 未提及的部分預設保持不變
  • 替換:Strictly edit @video1, change [舊特徵] to [新特徵] → 需明確說明要保留的關鍵元素
  • 移除:命名要刪除的元素,然後命名必須保留的元素 → 強調保留的元素效果更好
  • 延伸:Extend @video1 backward/forward: [接下來發生的事] → 風格、主體、故事必須指定為不變
  • 重新配樂:Keep @video1's picture and camera unchanged, replace the background music with @audio1 → 音訊編輯不會動到畫面
  • 橋接:@video1, [轉場描述], then @video2 → Seedance 2.5 上限提升至 10 個片段、30 秒

除此之外,Seedance 2.5 還支援時間戳定位的編輯(例如 replace the scene from 0:02 to 0:05 in @video1, keep the action and pacing)、綠幕替換、攝影機視角變更,甚至是重新打光、演員老化、風格切換、批量替換產品 SKU 顏色等進階操作,都歸類在「編輯」之下,不需要完全重新生成。

  • 如果延伸的片段在接縫處出現跳動:從第一個片段末尾修剪 6 幀,再從第二個片段開頭修剪 1 幀,然後拼接。
  • 如果重複延伸導致影像品質下降:先將來源轉換為白色 3D 模型渲染,再從那個乾淨的基礎進行延伸。

產業應用案例一覽

目前已浮現出清晰的應用場景,以下是五個主要產業的典型用法:

  • 電影:30 秒完整故事節拍、多演員素材構成的群體場景、去除鋼絲特效、主版本多語言重新配音
  • 廣告 / 電子商務:單鏡頭電視廣告敘事、產品外觀鎖定品牌素材、價格標籤重寫、出口市場更換主持人
  • 教育:30 秒解釋一個概念、原理視覺化、系列中一致的主持角色、多語言傳遞
  • 工業:組裝流程導覽、3D 白色模型產品預覽、跨產品線銘牌更換、多語言安全培訓
  • 娛樂 IP:遊戲風格預告片、虛擬偶像表演、節日主題皮膚影片、多語言虛擬主持

並非所有片段都需要嚴格的分鏡表。當一個片段倚賴單一連貫氛圍時,編號鏡頭的結構反而可以捨棄。例如這段 30 秒無對話的鄉村故事:

氛圍導向的提示詞範例
A 30-second wordless visual story with the quiet elegance of rural France, on a Provence summer afternoon. A young woman in an off-white linen dress finishes a handwritten letter at an old wooden table inside a stone cottage, steps out, follows a gravel path through a sunflower field, and slips the letter into a vintage yellow mailbox at the village edge. The camera opens on a shallow-focus close-up of the desk, passes through the doorway as light gives way to shadow, then rises and pulls back into a wide shot of the golden valley. Ambient sound only: cicadas, wind, the scratch of pen on paper, the soft click of the mailbox closing.

兩種模式都有效——端視你的片段是「故事節拍導向」還是「氛圍導向」。

廣告展示案例中,主版本是一支 12 秒的代言人廣告,腳本包含每秒的對話節拍。每個在地化版本之後只需一行編輯指令:

多語言替換範例
Swap the presenter for an American woman, re-voice the copy in English.
Swap the presenter for a Spanish man, re-voice the copy in Spanish.
Swap the presenter for an Indonesian woman, re-voice the copy in Indonesian.

常見問題

上線時還不行。7 月 31 日的發布首先涵蓋字節跳動自家應用(Jimeng AI、Doubao 專業版),API 與火山引擎遊樂場預計於 2026 年 8 月 7 日全面開放。有兩個存取細節值得注意:沒有免費額度,且啟用需要帳戶餘額超過 200 人民幣,或持有有效的 Seedance 2.0 資源包。

結構可以沿用:主體定義、@ 參考、編號鏡頭、對話和聲音包裝符號、參考/編輯/延伸的任務拆分,這些都原封不動地繼承到 2.5。你需要重新測試的是舊版的「 workaround(解法)」——因為 Seedance 2.0 的幾個痛點(短單次生成、粗略的編輯控制、不穩定的時間提示),正是 2.5 宣稱要修復的。

每個任務最多 50 個:30 張圖片、10 個影片片段、10 個音訊片段。影片參考總長最多 30 秒,音訊另外 30 秒,每個片段長度 2 到 30 秒。日常任務建議使用本文「參考槽位」章節的建議上限,不必一次塞滿。

可以。原生支援的語言包括中文、英文、西班牙文、印尼文、馬來文、泰文、阿拉伯文、葡萄牙文、越南文、日文和韓文等,主打「一個主版本,多語言發行」。建議在每句對話前標註語言,並可使用前述的口音控制模式。

單次生成 30 秒,並可在此基礎上進行多輪延伸以獲得更長的片段。請勿與「參考片段的 30 秒上限」混淆——後者是對輸入素材的預算,而非輸出。

結論:語法穩定,上限擴張

提示詞語言本身是穩定的部分:主體定義一次並用 @ 引用、鏡頭按順序編號、對話用花括號、約束條件放在結尾——這個語法在 2.0 時代寫出了 15 秒的片段,現在也能寫出 30 秒的片段。真正改變的,是圍繞它的上限。

今天就可以開始練習:在 Seedance 2.0 端點上熟練這個語法,保持參考集小而明確。一旦 Seedance 2.5 透過 API 開放,移植你的提示詞會是最簡單的一步。

原文出處Atlas Cloud Editorial Team在 atlascloud.ai 上閱讀原文
SSteven Lai影像導演 · 範本創作者查看所有文章
瀏覽其他分類