使用指南
Wan3.0 全能參考與首尾幀使用指南
全能參考模式
全能參考模式適合穩定重現主體、場景、動作或聲音。建議為每個素材分配清晰的引用名,例如 @Image1、@Video1 和 @Audio1。
範例:多模態主體與音訊參考
兩個人物圖片、兩份音訊和一個健身房場景可以共同控制角色身分與對白音色:
圖像/影片主體參考
適用場景包括人物一致性、角色卡、服裝、產品外觀、場景重現和動作參考。
提示詞至少應包含:
- 主體與素材的對應關係;
- 必須保持的髮型、臉部輪廓、服裝、配飾、顏色、材質和比例;
- 允許變化的表情、姿勢、鏡頭距離和環境動態;
- 參考影片的節奏、動作邏輯和切鏡方式。
影片時序參考
0–2 秒:主體居中展示,輕微轉頭;
2–2.4 秒:沿垂直中軸水平翻牌;
2.4–4.4 秒:下一主體居中展示;
重複上述節奏,最後一個主體穩定停留結束。國風頭飾範例採用「居中展示—水平翻牌—下一主體展示」的固定節奏:
音訊參考
主體1使用音訊1的音色,主體2使用音訊2的音色。
主體1轉頭說:「今天練哪個部位?」
主體2擦汗回應:「練背吧,昨天腿還痠著呢。」檔案/網頁參考
說明每個來源承擔的角色:人物設定、場景、分鏡、知識背景或視覺風格。避免讓同一份素材承擔互相衝突的約束。
影片編輯與延長
影片編輯應區分「保留項」和「修改項」,並標注修改發生的時間段。影片延長則要寫清楚「原片結尾狀態 → 延長段動作 → 新結尾狀態」。
首尾幀模式
分別描述首幀構圖、中間動作和尾幀構圖。首尾差異較大時,增加中間動作和時間節點,避免主體跳變、肢體不連續或場景重置。
Wan 3.0 Docs