Seedance 2.0 深度介紹:@ 參照系統如何讓 AI 影片製作從「祈禱」變成「導演」

sinpo.wang
·
·
IPFS
·
過去一年,我用過不少 AI 影片生成工具。體驗大致相同:輸入文字描述,按下生成,等待,看結果,嘆氣,修改描述,再按一次。重複直到湊合能用為止。

寫在前面

過去一年,我用過不少 AI 影片生成工具。體驗大致相同:輸入文字描述,按下生成,等待,看結果,嘆氣,修改描述,再按一次。重複直到湊合能用為止。

問題出在哪裡?文字無法精確傳達視覺意圖。「電影感的光線」到底是什麼意思?每個人想的不一樣,每個模型理解的也不一樣。

2026 年 2 月,字節跳動推出了 Seedance 2.0。用了三週之後,我確認這不是又一個「稍微好一點」的工具,而是根本性地改變了 AI 影片的製作方式。

核心差異:@ 參照系統

Seedance 2.0 不只接受文字,還能同時接收圖片(最多 9 張)、影片(最多 3 段)和音訊(最多 3 個)作為參考素材。每次生成最多投入 12 個檔案。

重點不在數量,而在角色指定。在提示詞中用 @ 標籤為每個檔案分配角色:「@Image1 是角色的臉部身份。@Image2 到 @Image6 是服裝參考。@Video1 是要複製的鏡頭運動。@Audio1 是背景音樂。」

同一張照片,指定為「角色臉部」會固定人物外貌,指定為「背景」會設定場景環境,指定為「風格參考」會影響整體色調。用途不同,結果完全不同。

這就是從「描述」到「展示」的轉變。文字無法精確傳達的東西——特定的色溫、某種鏡頭運動的質感、聲音的調性——都可以透過參考檔案直接呈現。

我的實際體驗

商品展示影片

上傳一張香水瓶照片。提示詞開頭寫保留指示:「保持瓶子的精確形狀、標籤文字、瓶蓋設計、玻璃材質。」然後描述鏡頭和光線:「攝影機緩慢順時針環繞。柔和青色光掃過表面。背景有細微霧氣。以正面特寫結束。」

結果令人驚訝。標籤文字完整保留。玻璃反射自然回應光線變化。而且已經有聲音了——柔和的環境音和玻璃共鳴聲自動生成。不需要另開音訊編輯軟體。

換裝序列

一張臉部照片作為身份參照,五張服裝照片作為穿搭參考,一段影片提供鏡頭轉場風格。同一個人換穿五套衣服的 15 秒影片一次生成完成。角色臉部完全一致,轉場效果跟隨參考影片風格。原生音訊自動加上了腳步聲和衣料摩擦聲。

動作轉移

舞蹈影片作為 @Video1 動作參照,另一個人的照片作為 @Image1 身份參照。「將 @Video1 的舞蹈動作精確轉移到 @Image1 的角色上。」原始的編舞以精確的時間配合轉移到了不同的人物和場景。

節拍同步 MV

音樂曲目作為 @Audio1。視覺風格圖片作為 @Image1~3。「鈸聲觸發場景切換,低音落入切換為慢動作。」模型分析了音樂的節奏結構,自動將視覺轉場對齊節拍。

需要注意的技巧

角色一致性需要「雙錨定」。只上傳身份參照圖片是不夠的,還需要在提示詞中用文字描述角色的外觀特徵:「短黑髮、白色亞麻襯衫、銀戒指。」圖片固定臉部,文字防止細節漂移。只用圖片會導致每次生成的角色微妙不同。

聲音方向要具體。「適當的背景音」只會得到平淡的結果。「腳步聲(混凝土地面)、雨聲、遠處交通聲、0:08 處雷聲、無音樂」才能生成有層次感的音景。

鏡頭術語使用英文最精準。Low-angle tracking、push-in、orbital、crane、Steadicam、Dutch angle。

保留指示寫在提示詞第一行。從圖片生成影片時,先寫明不能改變的元素,再描述要添加的動態效果。

規格與價格

最高 4K 解析度、10-bit 編碼、24fps。影片長度 4 到 15 秒,可延伸。原生立體聲音訊。發佈時基準:T2V ELO 1,269、I2V ELO 1,351,超越 Kling 3.0、Veo 3、Runway Gen-4.5。成功率超過 90%。

免費方案:註冊贈點,可商業使用,無浮水印。付費方案從月 $8.33(年繳)起。所有方案允許商業使用。

後續版本 Seedance 2.5(2026 年 7 月)支援 30 秒原生生成、50 個參考、4 模式編輯。兩個版本目前同時可用。

結語

Seedance 2.0 改變的不是生成品質(雖然品質確實很好),而是創作者與工具之間的溝通方式。從「輸入文字然後祈禱」到「用參考素材展示意圖然後導演」。

這個轉變聽起來微妙,實際上是決定性的。當你能精確傳達創作意圖時,工具才真正成為你的延伸,而不是你需要對抗的黑盒子。

CC BY-NC-ND 4.0 授权

喜欢我的作品吗?别忘了给予支持与赞赏,让我知道在创作的路上有你陪伴,一起延续这份热忱!