模型介绍
Wan3.0 多模态视频生成模型介绍
Wan3.0 是什么
Wan3.0 是面向视频创作与生产的多模态视频生成模型。它将参考图片、视频、音频、文档、网页和自然语言提示词组合起来,用于控制主体、动作、镜头、节奏和声音。
核心能力
- 全能参考:最多支持 20 个参考素材,覆盖图片、视频、音频、文档和网页。
- 原生 30 秒时长:支持更完整的叙事、更复杂的镜头安排和智能时长。
- 像素级一致性:加强人物、主体、服装、场景和参考细节的保持能力。
- 沉浸式视听:提升真实感、画面质感和音效表现。
- 精准视频编辑:支持自然语言指令和参考素材驱动的视频编辑。
适合的创作类型
Wan3.0 适合情绪写实、悬疑电影、喜剧短片、创意短片、科幻动画、灾难电影、荒诞短片、3D 风格化动画、2D 动画、运动番、暗黑奇幻和黏土动画等方向。
Wan 3.0 Docs