Doubao Seedance 2.0 系列(下文簡稱 Seedance 2.0 系列)模型原生支援音訊與影片聯合生成,擁有卓越的語意理解與多模態互動能力。本文介紹 Seedance 2.0 系列模型的提示詞(Prompt)使用方法和相關技巧,幫助您更高效地利用該模型生成符合需求的優質影片作品。
基礎公式
Seedance 2.0 系列模型支援同時參考影片、圖片、音訊等多模態素材,能精準鎖定人物樣貌、動作特效、視覺風格、配音音色等特徵,大幅降低提示詞編寫門檻。基於這一優勢,我們可以透過簡單的基礎公式來引導模型,利用多模態素材的特點,快速生成滿足特定需求的影片。
參考生影片可細分為三類任務:多模態參考、編輯影片和延長影片。您可根據任務類型選擇提示詞基礎公式。
多模態參考
從素材中提取部分元素(如主體、風格、場景、音效),生成一個全新影片。
<圖片N>中的<主體N>,生成...<影片N>中的<動作/運鏡/風格/音效>,生成...<音訊N>中的音色,生成...編輯影片
在原影片基礎上進行局部或全域修改。未提及的部分,預設保持不變。
<元素特徵> + <出現時機> + <出現位置><影片N>,將其中的<原特徵>修改為<新特徵>延長影片
在時間維度上延續原影片,要求音影片風格、主體與敘事保持一致。
<影片N>,生成...<影片1> + <過渡畫面描述> + 接 <影片2> + <過渡畫面描述> +接 <影片3><影片N>” 指代影片,請勿使用“參考<影片N>”,以免被誤判為參考任務。組合任務
上述3種任務也支援組合使用。
<圖片/影片N>的[參考維度],嚴格編輯<影片X>,[具體編輯內容]進階公式
Seedance 2.0 本質上是一個多模態 AI 導演:同時讀取你的文字提示詞、圖片、影片、音訊,並在內部拆成「空間層」(畫面裡有什麼)和「時間層」(事情如何隨時間變化)兩個維度來理解和生成畫面。
因此,好的提示詞不是單純的「文案型形容」,而是「工程型指令」:誰、在什麼場景、做什麼動作、鏡頭如何運動、按怎樣的時間順序發生,分別投遞給空間層和時間層。具體公式如下:
提示詞進階公式:精準主體 + 動作細節 + 場景環境 + 光影色調 + 鏡頭運鏡 + 視覺風格 + 畫質 + 約束條件
簡單說就是,先鎖定「誰」在「幹什麼」,再交代「在哪」,「什麼氛圍」,然後告訴模型「怎麼拍」,最後用風格、畫質和約束條件把結果收緊。下面詳細拆解各要素。
1 定義主體
實際參考的素材,一張圖片中往往存在多個主體,為了精準引用素材中的特定對象,必須進行明確的主體定義。主體可以是人物、道具、場景等。
<圖片/影片N>中的[主體核心特徵]定義為<主體N>當多個素材中的對象指向同一主體時,應統一綁定:
[...]、圖片2中的[...]定義為**<主體N>**當影片中存在多個主體時,需要分別定義,並使用標籤區分。標籤應具備唯一性與穩定性,後續描述中需持續使用對應標籤,避免指代混亂。
<主體N>@<圖片N>,強調主體和素材的綁定關係。例如:張三@圖片1。<圖片/影片N>指代主體。因模型無法直接關聯 Asset ID 與參考內容,故不得直接以 Asset ID 替代<圖片/影片N>。2 使用分鏡時序
模型的內部建模是空間和時間解耦的。因此,一個複雜影片的提示詞,最理想的型態是時間軸化分鏡:把影片拆成幾個分鏡,按事件發生順序動態描述每個分鏡: 誰 + 在哪 + 做什麼 + 鏡頭怎麼動。
實作建議
使用鏡頭順序,對每一段影片都寫一個簡單的「鏡頭 1 / 鏡頭 2 / 鏡頭 3」分鏡,再合併成完整的提示詞。
具體規則
鏡頭1、鏡頭2、鏡頭3等標識,按事件發生順序(先主後次)組織內容。不強制限制每段時長,優先讓模型根據劇情自然生成節奏。3 動作描述要求
抽象情緒 | 外化為動作與細節 |
悲傷 | 低頭、肩膀微微顫抖、眼眶泛紅、手指無意識地攥緊衣角、淚水在眼眶裡打轉但沒有落下 |
喜悅 | 嘴角抑制不住地上揚、眉眼舒展、腳步變得輕快、下意識地哼起小曲、忍不住原地轉個圈 |
緊張 / 焦慮 | 頻繁地看手錶、手指不停敲擊桌面、呼吸急促、眼神閃躲、無意識地啃咬指甲 |
憤怒 | 雙拳緊握、下頜線緊繃、胸口劇烈起伏、眼神如刀般銳利、從牙縫裡擠出話語 |
釋然 | 長長地舒了一口氣、緊繃的肩膀完全放鬆下來、臉上露出久違的、淡淡的微笑、抬頭望向遠方 |
4 運鏡寫法
模型對運鏡詞理解力很強,直接使用標準運鏡術語即可,例如「中景、特寫、全景、緩慢推鏡、平穩橫移、固定鏡頭」。
5 畫質、風格與約束詞
畫質、風格與約束詞是把控影片生成效果的關鍵,能夠為模型劃定創作邊界、統一畫質與美術調性,同時規避畫面瑕疵與隨機偏差,是保障成片效果穩定合規的必要配置。
1 畫質
定義畫面清晰度、細節紋理與光影質感,提升成片基礎畫質。
示例:高清,細節豐富,電影質感,色彩自然,光影柔和
2 風格
設定整體美術畫風與視覺調性,統一畫面藝術氛圍。
示例:賽博龐克冷藍紫色調、復古底片、日系清新
3 約束詞
約束詞十分重要,可有效規避畫面瑕疵、畸形崩壞及不合理元素,約束生成邊界與穩定性。
常用約束詞模板:
6 實戰案例
展示如何使用上文介紹的進階公式和各要素來編寫提示詞。
素材準備 :
提示詞 :
@圖片 1 中的女孩作為主角,@圖片 2 作為宿舍場景風格參考,參考 @影片 1 的運鏡方式。
鏡頭 1:傍晚時分,女孩 @圖片 1腳步輕快地走到宿舍門口 @圖片 2,鏡頭中景平穩跟拍,暖黃色日光從窗外灑進走廊,她在門口停頓一下,深呼吸,表情略帶緊張。
鏡頭 2:女孩 @圖片 1推開門走進宿舍,鏡頭切到室內中景,舍友們一邊整理書本一邊抬頭看向她,其中一人笑著問 {考得怎麼樣呀,過了嗎},鏡頭在幾人之間緩慢切換半身特寫。
鏡頭 3:女孩 @圖片 1先低頭露出落寞表情,鏡頭給到她的近景,隨後她抬頭憋不住笑意,哈哈大笑說 {騙你們的},舍友們追著打鬧起來,鏡頭緩慢拉遠,定格在宿舍內一片歡聲笑語的全景畫面。
全程畫面高清電影紀實風,色調溫暖,光影柔和;人物面部穩定不變形,動作自然流暢,無卡頓無閃爍;環境音效與 @音訊 1 自然融合。
素材準備 :
提示詞 :
@圖片 1 的紅衣女子作為女主,@圖片 2 的黑衣女子作為對手,場景參考 @圖片 3 的懸崖竹林環境,整體運鏡和動作節奏參考 @影片 1,背景音效與 @音訊 1 同步。
鏡頭 1:傍晚,鏡頭從紅衣女子 @圖片 1側面中景緩慢推進,她站在懸崖邊拿起酒壺喝酒,衣袂在山風中輕輕擺動,鏡頭環繞她半圈,從正面推到背影,遠處隱約可見竹林中的黑衣人影。
鏡頭 2:鏡頭變焦漸隱到遠景,無人機視角俯瞰整片懸崖和竹林,兩人分立山崖兩端,山風捲起衣擺和塵土,節奏隨鼓點略微加快。
鏡頭 3:鏡頭切回地面近景,二人緩慢拔劍對峙,紅衣女子@圖片 1 神情從漫不經心轉為冷冽,黑衣女子@圖片 2 目光堅毅,劍尖微微顫動,鏡頭平穩跟隨兩人繞圈移動,最後定格在兩劍相交前一瞬間的特寫。
整體畫面煙雨江湖電影感,冷調低飽和,電影膠片質感,光影層次豐富;人物臉部和身體比例穩定不變形,動作連貫自然,不僵硬,無穿模無卡頓。
其他技巧
文字生成
Seedance 2.0 系列模型支援生成常用文字。模型能根據情境自動匹配合適的風格與顏色,也支援在提示詞中指定文字的顏色、風格、出現方式、出現時機、出現位置。編寫時請優先使用常用字,避免生僻字與特殊符號,以確保最佳呈現效果。目前支援廣告語、字幕、氣泡等場景,具體寫法與案例請參閱文字生成。
影片延長 vs 分段拼接
實際製作中通常結合兩種方式,例如先用延長生成連貫對話,再拼接空鏡或轉場片段,兼顧沉浸感與節奏變化。
素材配置策略
通常把素材分成四種「功能角色」:
推薦配置(總計 4-5 個素材):角色圖 1-2 張(臉部特寫 / 全身)+ 場景圖 1 張 + 運鏡影片 1 段 + 音訊 1 段。
注意事項
語言規範
台詞語言需統一,避免中英文混用(專有名詞除外)。
特殊字元規範
提示詞中合理使用符號有助於模型準確理解不同資訊類型:
資訊類型 | 符號 | 示例 |
音樂 | () | (背景中播放著快節奏的搖滾樂) |
音效 | <> | <遠處傳來狗叫聲> |
台詞 | {} | {你好,世界}。如果台詞為小語種(非中英文),需標註語種,如:用日語說道{こんにちは}。 |
字幕 | 【】 | 【第一章:啟程】 |
常見問題
人物 ID 漂移
典型現象
生成的角色形象與參考圖不一致,或在影片中途發生「換臉」(ID 漂移),導致影片中人物撞臉明星被審核攔截。
根因分析
人臉參考圖的有效性不足
解決方案
強化人臉參考的獨立性與權重:
優化前 | 優化後 |
影片中人物中途「換臉」,撞臉明星 | 人臉與參考圖全程保持一致 |
影片中包含字幕
典型現象
提示詞中未要求生成字幕,生成的影片中包含字幕。
解決方案
影片中有 Logo / 浮水印
典型現象
提示詞中未提及浮水印相關內容,生成的影片包含其他影片平台的 Logo / 浮水印。
解決方案
在提示詞中加入明確的約束指令:「不要生成浮水印」、「不要生成Logo」 。
風格漂移
典型現象
期望生成 2D 或者 3D 動漫風格,但輸入的參考圖片的風格比較寫實,並且提示詞中未強調影片風格,生成的影片有機率漂移成真人寫實風格。
解決方案
在提示詞中加入明確的風格約束詞,例如「2D日漫風格」、「3D國風漫畫」。如果需要更精準的風格控制,建議將參考圖先變為目標風格再進行生成影片。
優化前 | 優化後 |
仙俠風格漂移成真人風格 | 保持 3D 國漫 CG 仙俠風格 |
延長影片銜接處跳變
典型現象
使用影片延長功能生成新影片後,將新影片與原影片進行拼接,在銜接處可能出現畫面跳變、回退的問題。
解決方案
目前建議透過後期剪輯修補,對齊關鍵幀,後續將依託模型迭代進行根本性最佳化。
優化前 | 優化後 |
在銜接處(第 5s,第20s)出現畫面瞬間跳動或內容回退 | 銜接處更加平滑 |
雙胞胎問題
典型現象
在畫面人物較多且傳入人物三視圖作為參考素材的場景下,生成影片同一畫面中易出現兩個完全相同的人物。
根因分析
解決方案
在提示詞中清晰定義每個人物角色,明確角色與參考圖的對應關係。建議在人物名稱後標註對應參考圖,並保持格式統一。
範例:張三(對應圖片 1)將綠色存摺扔向站立的李四(對應圖片 2)。
2. 添加全域約束指令
在提示詞末尾增加固定約束:影片全程禁止出現外形、著裝、配飾完全一致的人物,禁止生成同款分身、雙胞胎效果,同一畫面中僅保留單個對應人物,不出現人物重複複刻。
3. 最佳化參考素材
人物參考圖優先使用單人獨立照片,不建議使用三視圖、多視圖素材。
4. 精簡最佳化提示詞
請勿直接將完整劇本作為提示詞使用,文案內容過度冗餘易造成模型理解混亂,需精簡無關表述、確保指令清晰聚焦。
優化前 | 優化後 |
畫面第8秒出現「雙胞胎」 |
影片延長畫質劣化
典型現象
將模型生成的影片作為輸入素材進行延長續寫時,會出現畫質劣化。多次續寫會疊加劣化效果,尤其人物臉部區域易出現斑駁色塊。
解決方案
目前可透過以下方式緩解畫質劣化,後續將依託模型迭代進行根本性最佳化:
優化前 | 優化後 |
直接對模型產物進行續寫 | 將模型產物轉化為白模影片後再進行續寫 |
特效效果不符合預期
典型現象
透過提示詞文字描述特定特效時,可能會出現特效效果與預期不符的情況,例如:提示詞指定「數字「2999」以倒數計時動畫出場」,實際生成的數字滾動特效出現無序跳變,不符合標準倒數計時邏輯。
解決方案
建議採用參考影片定義特效:將目標特效影片作為參考素材輸入模型,讓模型精準理解特效形態與運動邏輯,生成效果更貼合預期。例如:數字「2999」出場方式參考影片1。
優化前 | 優化後 |
數字滾動特效有明顯的無序跳變感 | 增加正確的數字滾動特效影片後,特效結果符合預期 特效動畫 |
參考人物過多
典型現象
當參考人物數量超過 4 人時,模型輸出穩定性下降,生成的影片可能出現人物數量不符(如少人、多人)或人物重複等問題。
解決方案
目前可透過以下方式緩解,後續將依託模型迭代進行根本性最佳化:
優化前 | 優化後 |
輸入 8 個參考角色,輸出影片有 9 人 | 將 8 個角色生成 2 張圖後,再使用圖生影片 |
影片結尾有噪音
典型現象
影片中包含旁白時,影片片尾容易出現突兀咔噠聲、截斷雜音。
解決方案
重新生成影片,或使用剪映等剪輯工具,對片尾音軌透過音量包絡線做音訊淡出處理,消除截斷噪音。
具體步驟 (使用剪映):

優化前 | 優化後 |
結尾有噪音 | 結尾無噪音 |
中文發音不準
典型現象
模型對多音字、生僻字、形近字容易讀錯。
解決方案
可將易讀錯文字替換為發音一致的常用同音字,規避發音偏差,還原預期音訊效果。注意該方案僅為優化手段,無法完全規避所有發音問題。
範例:可將提示詞中「螭龍山」改寫為同音字「吃龍山」。
優化前 | 優化後 |
"螭龍山"的「螭」發音不對 | 改成「吃龍山」後發音正確 |
音色參考不準
典型現象
使用參考音訊指定音色時,最終生成影片的音訊音色與參考音色存在明顯偏差。
解決方案
優化前 | 優化後 |
音色與輸入音訊不匹配 輸入的音訊 | 提示詞中增加音色特徵描述後,音色匹配度明顯提升 「使用@音訊1低厚溫潤帶細碎顆粒感中年男聲的音色說」 |
附錄:提示詞案例
展示在不同場景下使用 Seedance 2.0 系列模型的提示詞範例,幫助您更精準地實現多模態參考的指代控制及文字生成等功能。
文字生成
廣告語(Slogan)
提示詞參考模板:
「文字內容」+「出現時機」+「出現位置」+「出現方式」,「文字特徵(顏色、風格)」
多圖參考 > Logo 參考。參考案例:
[成品效果]
[提示詞]
手繪漫畫風格,三個人圍坐在一起吃圖片1中的炸雞,氣氛友好愉悅,後畫面逐漸模糊,畫面中部顯示文字「快樂盡在 Seedance」。
[參考素材]

▲ 圖片 1
字幕
提示詞參考模板:
畫面底部出現字幕,字幕內容為「……」,字幕需與音訊節奏完全同步。
參考案例:
[成品效果]
[參考素材]

[提示詞]
生成帶有畫外音的影片。一個深沉、平靜的男聲說:「在宏大的宇宙中,我們的世界不過是一個短暫的瞬間。然而,在其中,生命不顧一切地繁榮。」場景應從夜晚緩慢過渡到黎明,星星逐漸消失,太陽從山後升起。畫面底部按照台詞出現字幕。
[成品效果]
[參考素材]

[提示詞]
圖片中的兩人在辦公室聊天,女性先說話,她說道:「你每次卡點到,是不是很享受這種剛剛好的感覺?」男性笑著回應:「我有我的節奏」角色說話時,對話隨意自然,畫面底部出現對應台詞字幕。
氣泡台詞
提示詞參考模板:
「角色」說:“……”,角色說話時周圍出現氣泡,氣泡裡寫著台詞。
參考案例:
[成品效果]
[參考素材]

[提示詞]
圖片1中的兩人穿著運動服在學校的操場跑步,女孩看向男孩,自信地笑著說:「We can definitely do it! 」鏡頭切到男孩的近景,他猶豫地回答:「Are you sure? 」鏡頭切回女孩的中近景,她語氣輕快地說:「Yes! 」情緒明亮而堅定。說話的角色周邊出現氣泡,氣泡裡是對應台詞。
[成品效果]
[參考素材]

[提示詞]
參考圖片1、圖片2中的女孩形象,女孩在一個草莓園裡,摘下一顆,吃了一口,笑著說:“This is the real deal! ”女孩周圍出現一個氣泡,氣泡裡面寫著台詞。
圖片參考
Seedance 2.0 系列模型既支援主體多視角參考,也支援場景圖、分鏡圖等多圖參考。
使用過程中,如對圖片順序有要求,應按順序上傳,提示詞中可使用圖片1、圖片2……圖片n進行準確指代。
主體多視角圖參考
指代清楚參考對象即可,模型能夠回應的指令包括但不限於以下範例。
商品:
3C 數位
[成品效果]
[參考素材]

[提示詞]
提取圖片1、圖片2、圖片3的相機,把背景換成白色,相機在一個白色桌子上,鏡頭以特寫的形式聚焦相機,然後以相機為主體緩慢旋轉,清晰展示相機的正面側面以及背面。
家居物品
[成品效果]
[參考素材]

[提示詞]
背景為暖調居家場景,中景呈現參考圖中的保溫杯,鏡頭平穩推近至保溫杯近景,鏡頭外一隻手自然入鏡輕握杯身拿起保溫杯,鏡頭跟拍手部微微旋轉動作展示。
角色:
[成品效果]
[提示詞]
參考圖片1、圖片2、圖片3中的女子形象,生成她在一家咖啡店吃蛋糕的畫面。
[參考素材]

多圖參考
Logo 參考
[成品效果]
[參考素材]

[提示詞]
背景是霓虹閃爍的未來都市空中廊道,飛行器與全息廣告交織,參考圖片2中的女孩,先用中景展示女孩放飛帶有全息投影的銀色懸浮燈,再鏡頭拉遠展現漫天懸浮燈,畫面逐漸模糊,後出現圖片1的 Logo,整體風格為 3D 賽博龐克科幻動畫風格。
多主體參考
[成品效果]
[參考素材]

[提示詞]
參考圖片中的貓貓和狗狗,在一個溫馨的公寓裡,狗狗在趴著吃狗糧,貓貓走過來,伸出爪子碰了碰狗狗,狗狗看到貓貓後停下吃飯,貓貓依偎在狗狗身邊。畫面採用暖色調。
多元素參考
[成品效果]
[參考素材]

[提示詞]
場景設定在圖片4中的餐廳內,店內人來人往。圖片1裡的女孩身著圖片2中的服裝,正在整理櫃檯上的物品。圖片3中的男孩是一位顧客,他走上前,想要向女孩索取聯絡方式。圖片5中的標識始終顯示在畫面的右下角。
多宮格分鏡圖參考
[成品效果]
[參考素材]

[提示詞]
參考圖片中的分鏡圖,生成打鬥激烈的打鬥場面。圖片中的各個分鏡構圖要按照順序出現,之後二人激烈打鬥。
分鏡圖參考
[成品效果]
[參考素材]

[提示詞]
參考圖片3中的分鏡構圖,女孩正在等爸爸做好飯,她說:「아빠, 배고파요! 밥 다 됐어요?」,女孩形象參考圖片1。接著鏡頭向右橫搖,切換至圖片4的畫面和構圖,爸爸形象參考圖片2,爸爸回答她:「거의 다 됐어, 조금만 기다려!」,接著鏡頭切換回女兒略顯失落的面部表情特寫,她說:「아직 멀었어요? 맛있는 냄새 나는데。。。」,接著切換成爸爸的面部特寫,他說:「이제 진짜 금방이야。 "빨리빨리" 하지 말고 손부터 씻고 와!」。
影片參考
Seedance 2.0 系列模型支援影片參考,使用時指代清楚生成內容和參考對象即可。
使用過程中,如對影片順序有要求,應按順序上傳,提示詞中可使用影片1、影片2……影片n進行準確指代。
動作參考
影視
[成品效果]
[參考素材]
▲ 影片 1

[提示詞]
參考影片1的人物動作和鏡頭語言,生成圖片2和圖片1的打鬥場面,圖片2是左邊人物,圖片1是右邊人物。有激烈的背景音樂。
行銷
[成品效果]
[參考素材]
▲ 影片 1
[提示詞]
參考影片1中馬的奔跑形態,生成一匹金色的駿馬在草原上奔跑,隨即定格其奔跑的華麗姿態,變成一個馬形的金吊墜。
運鏡參考
[成品效果]
[提示詞]
參考影片1的運鏡,做一個科技園區的概念影片,以圖片1中的高樓為視覺中心,同為第一視角俯衝,體現出圖片1中園區的科技感。
[參考素材]
▲ 影片 1

▲ 圖片 1
特效參考
影視
[成品效果]
[參考素材]
▲ 影片 1

▲ 圖片 1
[提示詞]
參考影片1的金色粒子特效,讓圖片2中的人物吹笛子的同時,身邊環繞一樣的粒子特效。
玩法特效
[成品效果]
[參考素材]
▲ 影片 1

▲ 圖片 1
[提示詞]
參考影片1的特效,讓圖片1中的女生長出相同的翅膀,翅膀生成軌跡一致。
影片編輯
Seedance 2.0 系列模型支援影片編輯,支援增加、刪除或修改元素,影片的向前或向後延長,以及軌道補齊。
使用過程中,如對影片順序有要求,應按順序上傳,提示詞中可使用影片1、影片2……影片n進行準確指代。
元素增刪改
增加元素
[成品效果]
[參考素材]
▲ 影片 1
[提示詞]
在影片1的檯面上添加炸雞、披薩等小吃。
刪除元素
[成品效果]
[參考素材]
▲ 影片 1
[提示詞]
清除影片1桌面上的其他零件和工具,保持桌面整潔乾淨,桌面上只有他倆手裡的。
修改元素
[成品效果]
[參考素材]
▲ 影片 1

▲ 圖片 1
[提示詞]
將影片1中的香水替換成圖片1中的面霜,動作和運鏡不變。
影片延長
向後延長
[成品效果]
[參考素材]
▲ 影片 1
[提示詞]
生成影片1之後的內容,遲到的兩個男士跑向他們,五個人終於見面,友好聊天。
向前延長
[成品效果]
[參考素材]
▲ 影片 1
[提示詞]
向前延長
影片1,給白衣男子過肩鏡頭,白衣男子說:“It’s not that bad. You're just stressed. Everyone goes through this, you just need to keep going.”
軌道補齊
參考案例:
[成品效果]
[提示詞]
影片1,樹葉落地的瞬間,激起金色粒子特效,一陣風吹過,接影片2。
[參考素材]
▲ 影片 1
▲ 影片 2