Introducción al modelo
Introducción al modelo de generación de video multimodal Wan3.0
Qué es Wan 3.0
Wan3.0 es un modelo de generación de video multimodal orientado a la creación y producción de video. Combina imágenes, videos, audio, documentos, páginas web de referencia y prompts en lenguaje natural para controlar el sujeto, la acción, el encuadre, el ritmo y el sonido.
Capacidades principales
- Referencia total: admite hasta 20 materiales de referencia, incluyendo imágenes, videos, audio, documentos y páginas web.
- Duración nativa de 30 segundos: permite narrativas más completas, encuadres más complejos y una duración inteligente.
- Consistencia a nivel de píxel: refuerza la conservación de personajes, sujetos, vestuario, escenas y detalles de referencia.
- Audio y video inmersivos: mejora el realismo, la calidad visual y el rendimiento del sonido.
- Edición de video precisa: admite edición de video mediante instrucciones en lenguaje natural y materiales de referencia.
Tipos de creación adecuados
Wan3.0 es adecuado para realismo emocional, cine de suspenso, cortometrajes de comedia, cortometrajes creativos, animación de ciencia ficción, películas de catástrofes, cortometrajes absurdos, animación 3D estilizada, animación 2D, anime deportivo, fantasía oscura y animación de plastilina, entre otras direcciones.
Wan 3.0 Docs