Seedance 2.5 已於 2026 年 7 月 31 日正式上線,率先在 Jimeng AI 與 Doubao 專業版推出,後續將透過火山引擎開放 API。輸出長度從 15 秒翻倍到 30 秒,參考素材上限從十幾個拉到 50 個,編輯控制也更精細——但所有這些升級,其實都只獎勵同一種技能:像寫分鏡表一樣撰寫提示詞,讓每個參考檔案都各司其職。
對曾經學過 Seedance 2.0 的人來說,好消息是:核心語法幾乎沒有變。Seedance 2.5 保留了同樣的三種任務拆分(參考、編輯、延伸),改變的是你能「餵」給它的素材量,以及模型必須維持一致性的時間跨度。本篇指南將帶你一次看懂兩者。
重點摘要:Seedance 2.5 帶來了什麼?
- 單次生成可達 30 秒,每個任務最多接受 50 個參考素材:30 張圖片、10 個影片片段、10 個音訊片段。
- 核心提示詞結構繼承自 Seedance 2.0:定義主體 → 編寫編號鏡頭 → 用 {} 包裹對話 → 品質詞 + 約束詞收尾。
- 編輯提示詞有一條嚴格規則:只有在「借用特徵」時才寫
reference @video1;若要修改該片段本身,直接命名影片,否則模型可能把你的編輯誤判為參考任務。 - 截至 2026 年 7 月 31 日,Seedance 2.5 尚未在 Atlas Cloud 上架;目前 Atlas Cloud 上的 Seedance 2.0 系列已使用相同參考語法,價格約為每秒 0.09 美元(含當日生效的 20% 折扣)。
四項關鍵升級,改變提示詞寫法
對鍵盤操作者來說,Seedance 2.5 有四項升級最有感:
- 輸出長度翻倍:從 15 秒拉長到 30 秒。
- 參考上限三倍:從十幾個增至 50 個素材。
- 編輯成為一級任務:擁有自己的語法,不再只是附屬功能。
- 對話原生支援十幾種語言:不再只有中英兩語。
字節跳動宣稱 30 秒輸出與 50 個素材上限為「世界首創」,請將其視為行銷用語,而非業界既定標竿。真正影響輸出品質的是:燈光、運鏡、表演與情緒可讀性都有顯著提升,AI 痕跡也大幅減少。
無論如何,仍建議養成一個習慣:即便低於 30 秒上限,結構化的提示詞表現依然更佳。更長的畫布只會「放大」飄移,而非隱藏它。
現在就可以練習:在 Atlas Cloud 上使用 Seedance 提示詞
截至 7 月 31 日,Seedance 2.5 尚未登陸第三方平台,API 與火山引擎遊樂場預計於 2026 年 8 月 7 日全面開放。本週最務實的做法,是先在 Seedance 2.0 系列上演練完全相同的參考語法——@ 主體語法、參考槽位、編輯動詞,全部互通。
Seedance 2.0 系列已透過 Atlas Cloud 的 Seedance 模型家族提供,包含文字轉影片、圖片轉影片,以及多模態的參考轉影片遊樂場。定價採代幣制:
- 參考端點 720p 輸出:每秒 0.2419 美元;若任務包含影片輸入,則降至每秒 0.1486 美元。
- 文字轉影片卡片標價約每秒 0.112 美元,加上 2026 年 7 月 31 日生效的 20% 折扣後約為 0.09 美元/秒。
- Seedance 2.0 Fast 折扣後約每秒 0.072 美元,輕量版 Mini 約為 0.045 美元。
網站上的折扣設有倒數計時器,在為專案編列預算前,請先至模型頁面確認當前價格。
登入後開啟「參考轉影片遊樂場」,無需撰寫程式碼即可執行所有模式。在左側上傳參考檔案,然後在提示詞框中輸入 @,就能將主體綁定到特定的圖片、影片或音訊槽位。
頁面上的預設範例很值得當作模板閱讀——每個重要的名詞都與 @image 綁定,模型永遠不會猜錯你指的是哪個城市或哪個機器人。
- 取得 API 金鑰:在 Atlas Cloud 控制台中建立一個,然後複製它。
- 查閱 API 文件:端點、參數與驗證資訊都寫在文件中。
- 發出第一個請求:參考端點接受提示詞,以及每種參考類型的平行陣列。
curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $ATLASCLOUD_API_KEY" \
-d '{
"model": "bytedance/seedance-2.0/reference-to-video",
"prompt": "Define the woman in @image1 as Mara. Shot 1: medium tracking shot, Mara walks through the night market @image2, neon reflections on wet pavement. <sizzling from food stalls>",
"reference_images": ["https://your-cdn/mara-face-closeup.jpg", "https://your-cdn/night-market.jpg"],
"reference_videos": [],
"reference_audios": [],
"duration": -1,
"resolution": "720p",
"ratio": "16:9",
"generate_audio": true
}'把 duration 設為 -1,可讓模型在此端點 4 到 15 秒的範圍內自行選擇自然長度。接著輪詢回傳的 prediction ID 直到完成:
curl https://api.atlascloud.ai/api/v1/model/prediction/<prediction_id> \
-H "Authorization: Bearer $ATLASCLOUD_API_KEY"完成的回應會包含託管影片的 URL。由於 Atlas Cloud 在整個平台上使用統一 API,未來 Seedance 2.5 推出後,你只需把模型字串換成新名稱,參考陣列、輪詢迴圈和提示詞檔案都能維持不變。
Seedance 2.5 提示詞公式(繼承自 2.0)
把模型想像成一位多模態導演:它讀取你的文字、圖片、影片和音訊,然後把任務拆成「空間層」(畫面中有什麼)與「時間層」(隨時間如何變化)。這對應到一個六槽公式,前兩個槽之後的內容皆為可選:
- 主體 + 動作或事件 + 場景與環境 + 視覺風格 + 運鏡 + 聲音
Seedance 2.0 時代常用的燈光詞、品質詞、約束尾句(例如 no subtitles, no watermark)一樣可以塞進這些槽位,你之前學過的東西都不會浪費。
生成設定(如時長、解析度)應完全排除在提示詞之外,它們屬於介面或 API 參數,不屬於文字提示的一部分。
六個槽位在實務上可以濃縮為四行可寫的內容。關鍵在於:主體永遠優先定義——在模型知道你要的是哪張臉之前,參考素材毫無用處。每個主體只要定義一次,附帶兩三個穩定特徵,之後就重複使用該標籤。
Define the woman in @image1 (red dress, straw hat) as Mara.
Mara walks along the pier at dusk...
// ...接續動作、場景、風格、運鏡、聲音- 為每個
@參考賦予即時的任務描述,清楚說明模型應忽略的部分,例如:in the style of '@image1 for the potter's features, hair, and green apron, not the image background'。 - 使用貼近臉部的特寫作為獨立圖片,與全身照分開——這是 Seedance 2.0 時代對抗身分飄移的經典技巧,現在依然有效。
- 小心處理多角度:主體 ≤ 5 個時,單視角或多視角圖片皆可;超過 5 個時,最好堅持單視角,把角度分鏡圖拆成獨立圖片並明確宣告,例如:
these four images define the same folding lamp; only one lamp appears in the video。
聲音和文字各自有專屬的包裝符號,避免模型把對話誤認為字幕:
- 對話:使用
{ },例如She smiles and says {We can definitely do it} - 音樂:使用
( ),例如(upbeat rock plays in the background) - 音效:使用
< > - 螢幕字幕:使用
【 】,例如【Chapter One: Departure】
將每句對話保持在單一語言中,並在花括號前標明語言。若要控制口音,可使用專屬模式:語言、地區變體、語氣、說話者,然後是台詞,例如:
Dialogue language: natural, conversational American English.
The girl says: {I thought you weren't coming.}50 個參考槽位怎麼用才對?
Seedance 2.5 的 50 個槽位分配為:30 張圖片 + 10 個影片片段 + 10 個音訊片段。影片和音訊的時間預算是分開計算的:最多 30 秒的影片參考,加上另外 30 秒的音訊參考,每個片段長度介於 2 到 30 秒之間。
- 圖片:最高支援 4K、30 MB
- 影片:最高支援 4K、200 MB
- 音訊:15 MB 的 mp3 或 wav 格式
槽位數量是 Seedance 2.0 的三倍、參考素材長度翻倍,但並不代表你應該一次塞好塞滿。素材越多,模型越容易混淆;重點在精準,不在數量。
- 音訊或影片主體參考:控制在 5 個以下(複雜任務最多 6–10 個)
- 主體圖片:控制在 8 張以下(最多 9–12 張)
- 單個片段長度:以 5–10 秒為佳——少於 2 秒身分資訊不足;完整 30 秒則會稀釋你想複製的特徵
當素材開始堆積,建議的刪減順序是:核心角色 → 關鍵產品/道具 → 場景 → 整體風格。愈核心的東西,愈值得保留參考。
答案是:群體場景。一個旗艦展示案例是 30 秒的宮廷宴會,由 20 個編號的角色和道具圖片加上三個聲音樣本構成,每個賓客都與 @參考 綁定。多角色群體場景、武俠動作序列、把動作遷移到攀爬大猩猩身上——這類展示案例,都依賴大量堆疊的完整模態參考。
寫分鏡表,讓 30 秒提示詞保持連貫
最值得延續的單一習慣:停止撰寫氛圍文案,開始撰寫編號鏡頭。A man runs through the street, very cinematic 無法為時間層提供任何排程依據;分鏡表則可以:
Define the girl in @image1 as Lin. @image2 sets the dorm scene. Reference @video1 for camera movement.
Shot 1: medium tracking shot, early evening. Lin walks to the dorm door, pauses, takes a slow breath, slightly nervous. Warm light from the corridor window.
Shot 2: cut to interior medium shot. Lin pushes the door open. Roommates look up from their desks. One asks {So? Did you pass?}. Slow half-body cuts between faces.
Shot 3: close-up on Lin. She lowers her head, then breaks into a laugh and says {Got you all}. The roommates chase her around. Camera pulls back to a wide shot of the room.
Documentary realism, warm tones, soft light. Faces stay stable. No subtitles, no watermark.每個鏡頭都回答同樣四個問題:
- 運鏡:每個鏡頭從一個動作開始,使用標準術語,例如
slow push-in、fixed camera、cut to close-up - 動作:身體部位 + 速度或力度,例如
slowly raises a hand、grips the strap hard - 空間:主體現在的位置,例如
at the dorm door、crossing the rooftop - 音訊:此鏡頭的對話、音效或音樂,例如
{台詞}、<音效>、(音樂)
- 量化動作:用
slowly、sharply、slightly這類副詞,並指明是哪個部位在動。 - 把情緒外化,而非標籤化:與其寫
she is sad,不如寫head down, shoulders trembling slightly, fingers twisting the hem of her jacket——後者才能讓畫面活起來。
另外,Seedance 2.0 時代「每個鏡頭只能有一個運鏡動作」的限制已經放鬆。Seedance 2.5 可以處理組合動作,例如在一個運動員入場的長鏡頭中同時進行跟拍、起重機升降和旋轉,而且執行穩定。建議從簡單開始,當鏡頭值得時再做組合。
時機控制是 Seedance 2.5 與前代最大的不同。在 Seedance 2.0 中,精確到秒的提示常導致生成不穩定;這個限制在 2.5 已經消失——你現在可以全程使用時間碼,例如 [0-3s]、[3-5s]、[5-10s],或根據旁白逐秒編寫。
鏡頭順序依然承載故事,秒數範圍則讓你能夠精確定位某個節拍落在 30 秒內的哪個位置。
編輯提示詞:只改一件事,保留其餘
編輯是最考驗措辭的地方,因為一個動詞就決定了任務類型。規則很明確:
只有當你想把特徵「借用到新影片」時,才寫 reference @video1。當你想修改該片段本身時,直接命名它(@video1、strictly edit @video1),否則模型可能把你的任務誤判為參考任務,並重新生成整個場景。
好的編輯提示詞可以濃縮為三個動作:
- 用
@video1指向來源 - 精確限定哪些部分要改(若更換主體,則加入參考圖片)
- 最後以一條鎖定行結尾,例如
everything else stays unchanged,避免模型亂改你沒提到的部分
有兩個參數你無法控制:編輯後的片段會保留來源的寬高比與大約時長。延伸也會繼承寬高比,但增加的長度可以在提示詞中設定(例如 extend by 6 seconds)。
- 添加:描述新元素、何時出現、何處出現 → 未提及的部分預設保持不變
- 替換:
Strictly edit @video1, change [舊特徵] to [新特徵]→ 需明確說明要保留的關鍵元素 - 移除:命名要刪除的元素,然後命名必須保留的元素 → 強調保留的元素效果更好
- 延伸:
Extend @video1 backward/forward: [接下來發生的事]→ 風格、主體、故事必須指定為不變 - 重新配樂:
Keep @video1's picture and camera unchanged, replace the background music with @audio1→ 音訊編輯不會動到畫面 - 橋接:
@video1, [轉場描述], then @video2→ Seedance 2.5 上限提升至 10 個片段、30 秒
除此之外,Seedance 2.5 還支援時間戳定位的編輯(例如 replace the scene from 0:02 to 0:05 in @video1, keep the action and pacing)、綠幕替換、攝影機視角變更,甚至是重新打光、演員老化、風格切換、批量替換產品 SKU 顏色等進階操作,都歸類在「編輯」之下,不需要完全重新生成。
- 如果延伸的片段在接縫處出現跳動:從第一個片段末尾修剪 6 幀,再從第二個片段開頭修剪 1 幀,然後拼接。
- 如果重複延伸導致影像品質下降:先將來源轉換為白色 3D 模型渲染,再從那個乾淨的基礎進行延伸。
產業應用案例一覽
目前已浮現出清晰的應用場景,以下是五個主要產業的典型用法:
- 電影:30 秒完整故事節拍、多演員素材構成的群體場景、去除鋼絲特效、主版本多語言重新配音
- 廣告 / 電子商務:單鏡頭電視廣告敘事、產品外觀鎖定品牌素材、價格標籤重寫、出口市場更換主持人
- 教育:30 秒解釋一個概念、原理視覺化、系列中一致的主持角色、多語言傳遞
- 工業:組裝流程導覽、3D 白色模型產品預覽、跨產品線銘牌更換、多語言安全培訓
- 娛樂 IP:遊戲風格預告片、虛擬偶像表演、節日主題皮膚影片、多語言虛擬主持
並非所有片段都需要嚴格的分鏡表。當一個片段倚賴單一連貫氛圍時,編號鏡頭的結構反而可以捨棄。例如這段 30 秒無對話的鄉村故事:
A 30-second wordless visual story with the quiet elegance of rural France, on a Provence summer afternoon. A young woman in an off-white linen dress finishes a handwritten letter at an old wooden table inside a stone cottage, steps out, follows a gravel path through a sunflower field, and slips the letter into a vintage yellow mailbox at the village edge. The camera opens on a shallow-focus close-up of the desk, passes through the doorway as light gives way to shadow, then rises and pulls back into a wide shot of the golden valley. Ambient sound only: cicadas, wind, the scratch of pen on paper, the soft click of the mailbox closing.兩種模式都有效——端視你的片段是「故事節拍導向」還是「氛圍導向」。
廣告展示案例中,主版本是一支 12 秒的代言人廣告,腳本包含每秒的對話節拍。每個在地化版本之後只需一行編輯指令:
Swap the presenter for an American woman, re-voice the copy in English.
Swap the presenter for a Spanish man, re-voice the copy in Spanish.
Swap the presenter for an Indonesian woman, re-voice the copy in Indonesian.常見問題
上線時還不行。7 月 31 日的發布首先涵蓋字節跳動自家應用(Jimeng AI、Doubao 專業版),API 與火山引擎遊樂場預計於 2026 年 8 月 7 日全面開放。有兩個存取細節值得注意:沒有免費額度,且啟用需要帳戶餘額超過 200 人民幣,或持有有效的 Seedance 2.0 資源包。
結構可以沿用:主體定義、@ 參考、編號鏡頭、對話和聲音包裝符號、參考/編輯/延伸的任務拆分,這些都原封不動地繼承到 2.5。你需要重新測試的是舊版的「 workaround(解法)」——因為 Seedance 2.0 的幾個痛點(短單次生成、粗略的編輯控制、不穩定的時間提示),正是 2.5 宣稱要修復的。
每個任務最多 50 個:30 張圖片、10 個影片片段、10 個音訊片段。影片參考總長最多 30 秒,音訊另外 30 秒,每個片段長度 2 到 30 秒。日常任務建議使用本文「參考槽位」章節的建議上限,不必一次塞滿。
可以。原生支援的語言包括中文、英文、西班牙文、印尼文、馬來文、泰文、阿拉伯文、葡萄牙文、越南文、日文和韓文等,主打「一個主版本,多語言發行」。建議在每句對話前標註語言,並可使用前述的口音控制模式。
單次生成 30 秒,並可在此基礎上進行多輪延伸以獲得更長的片段。請勿與「參考片段的 30 秒上限」混淆——後者是對輸入素材的預算,而非輸出。
結論:語法穩定,上限擴張
提示詞語言本身是穩定的部分:主體定義一次並用 @ 引用、鏡頭按順序編號、對話用花括號、約束條件放在結尾——這個語法在 2.0 時代寫出了 15 秒的片段,現在也能寫出 30 秒的片段。真正改變的,是圍繞它的上限。
今天就可以開始練習:在 Seedance 2.0 端點上熟練這個語法,保持參考集小而明確。一旦 Seedance 2.5 透過 API 開放,移植你的提示詞會是最簡單的一步。
