Modelo de vídeo Wanxiang 2.6 de Alibaba Tongyi Lab. Genera clips narrativos a partir de texto o imágenes con storytelling multiplano, consistencia de personaje/referencia y sincronización audiovisual — hasta unos 15 segundos a hasta 1080p según la configuración.
Con tecnología de Alibaba Tongyi Wanxiang
Wan 2.6 (Tongyi Wanxiang 2.6) es un modelo de generación de vídeo con IA de Alibaba Tongyi Lab. Se centra en la generación narrativa multiplano, la consistencia de personajes guiada por referencia y la sincronización audiovisual nativa — junto con flujos estándar de texto a vídeo e imagen a vídeo. La duración y la resolución dependen de la configuración del proveedor (comúnmente hasta ~15 segundos y hasta 1080p).
Convierte un prompt tipo guion en una secuencia coherente de planos. Wan 2.6 está diseñado para mantener sujetos, escenas y atmósfera más consistentes entre cortes que los modelos de un solo plano.
Genera audio a juego con el vídeo — incluidos lip sync orientado al diálogo y pistas ambientales o de efectos cuando la generación de audio está activada — reduciendo el montaje separado de banda sonora en muchos borradores.
Usa imágenes o clips de referencia para mantener más estable el aspecto del personaje (y en algunos modos la voz) al colocarlo en nuevas escenas — útil para borradores narrativos cortos y de estilo IP.
Parte de un prompt de texto detallado o anima una imagen fija. Relaciones de aspecto como 16:9, 9:16 y 1:1 suelen admitirse según los ajustes de generación que elijas.
Wan 2.6 apunta a borradores narrativos y de marketing de formato corto donde la estructura multiplano y el audio sincronizado importan tanto como un solo plano hermoso.
Capacidades centrales comúnmente asociadas a la generación de vídeo Alibaba Tongyi Wanxiang 2.6.
Describe escena, acción, cámara y estilo en lenguaje natural para generar un clip de vídeo corto.
Anima una imagen fija buscando preservar la identidad del sujeto y la composición del fotograma de origen.
Pide varios planos o segmentos tipo storyboard para que el clip se lea como una narrativa corta en lugar de una sola toma continua.
Opcionalmente genera audio sincronizado con lo visual, incluida la sincronización orientada al habla cuando el diálogo forma parte del prompt.
Usa referencias para guiar la apariencia del personaje o la continuidad de estilo en escenas recién generadas (la disponibilidad depende del modo de generación).
Relaciones de aspecto habituales como horizontal, vertical y cuadrado ayudan a adaptar feeds, stories e embeds del sitio.
Preguntas habituales sobre Wan 2.6 y el uso de herramientas de vídeo AI en SeeVid.
Explora storytelling multiplano y flujos de vídeo AI con audio. Abre el generador, elige un modelo disponible y empieza a redactar tu próximo clip.