Modèle vidéo Wanxiang 2.6 d’Alibaba Tongyi Lab. Générez des clips narratifs à partir de texte ou d’images avec storytelling multi-plans, cohérence personnage/référence et sync audiovisuelle — jusqu’à environ 15 secondes à jusqu’à 1080p selon les réglages.
Propulsé par Alibaba Tongyi Wanxiang
Wan 2.6 (Tongyi Wanxiang 2.6) est un modèle de génération vidéo IA d’Alibaba Tongyi Lab. Il se concentre sur la génération narrative multi-plans, la cohérence de personnage guidée par référence et la synchronisation audiovisuelle native — en plus des flux texte vers vidéo et image vers vidéo. La durée et la résolution dépendent de la configuration du fournisseur (souvent jusqu’à ~15 secondes et jusqu’à 1080p).
Transformez un prompt façon script en une séquence cohérente de plans. Wan 2.6 est conçu pour garder sujets, scènes et atmosphère plus cohérents d’une coupe à l’autre que les modèles mono-plan.
Générez un audio assorti à la vidéo — y compris lip sync orienté dialogue et indices d’ambiance ou d’effets lorsque la génération audio est activée — réduisant le montage séparé de bande-son pour de nombreux brouillons.
Utilisez des images ou clips de référence pour stabiliser l’apparence d’un personnage (et dans certains modes la voix) dans de nouvelles scènes — utile pour de courts brouillons narratifs et style IP.
Partir d’un prompt texte détaillé ou animer une image fixe. Des formats comme 16:9, 9:16 et 1:1 sont souvent pris en charge selon les réglages de génération choisis.
Wan 2.6 cible les brouillons narratifs et marketing courts où la structure multi-plans et l’audio synchronisé comptent autant qu’un seul beau plan.
Capacités centrales souvent associées à la génération vidéo Alibaba Tongyi Wanxiang 2.6.
Décrivez scène, action, caméra et style en langage naturel pour générer un court clip vidéo.
Animez une image fixe en visant à préserver l’identité du sujet et la composition du cadre source.
Promptéz plusieurs plans ou segments type storyboard pour que le clip se lise comme une courte narration plutôt qu’une prise continue.
Générez éventuellement un audio synchronisé avec le visuel, y compris une sync orientée parole lorsque le dialogue fait partie du prompt.
Utilisez des références pour guider l’apparence du personnage ou la continuité de style dans des scènes nouvellement générées (disponibilité selon le mode).
Des formats courants paysage, portrait et carré aident à coller aux feeds, stories et embeds de site.
Questions courantes sur Wan 2.6 et les outils vidéo IA sur SeeVid.
Explorez le storytelling multi-plans et les flux vidéo IA avec audio. Ouvrez le générateur, choisissez un modèle disponible et commencez le brouillon de votre prochain clip.