La mise à niveau production de HappyHorse par Alibaba ATH. Créez des clips de 3–15 secondes en 720p ou 1080p avec génération audio-vidéo conjointe, lip sync multilingue et cohérence référence-vers-vidéo sur jusqu’à neuf images — disponible sur SeedDance.
Powered by Alibaba ATH · Disponible sur SeedDance

HappyHorse 1.1 est le modèle de génération vidéo IA amélioré d’Alibaba ATH (Groupe Taotian), publié en juin 2026. Basé sur un Transformer unifié d’environ 15B paramètres qui génère vidéo et audio synchronisé en une seule passe, il améliore cinq dimensions de production par rapport à HappyHorse 1.0 : expressivité du mouvement, cohérence du sujet, suivi des instructions, qualité visuelle et sync audiovisuelle — tout en conservant les mêmes specs 3–15 secondes / 720p–1080p pour une migration simple.
Dialogue, ambiance, Foley et cues musicaux sont générés avec l’image en une seule passe — lip sync, rythme et action à l’écran restent alignés sans pipeline de doublage séparé.
La référence-vers-vidéo verrouille personnages, produits, packaging et environnements d’un clip à l’autre. Téléversez 1–9 images et liez-les dans le prompt pour une cohérence de marque et d’IP plus forte qu’avec le texte seul.
La version 1.1 vise une action plus fluide (danse, sport, rotations produit) et un respect plus précis des instructions caméra, lumière et plan par plan — moins de relances pour les équipes de production.
Lip sync sensible aux phonèmes dans les langues majeures : anglais, mandarin, cantonais, japonais, coréen, allemand et français — utile pour les pubs localisées et les variantes talking-head.
Conçu pour les workflows de production short-form — pubs sociales, démos e-commerce, beats de short drama et marketing multilingue — avec des specs claires et les crédits SeedDance.

Capacités disponibles dans le générateur vidéo IA SeedDance pour HappyHorse 1.1.
Décrivez scènes, mouvements de caméra, performance et dialogue en langage naturel. Prend en charge une direction détaillée plan par plan pour de courtes narrations multi-beats.
Animez une image fixe en préservant sujet et style. Ajoutez un prompt de motion optionnel pour guider caméra et action.
Téléversez 1–9 images de référence pour verrouiller personnages, produits et environnements. Mentionnez les sujets dans le prompt pour une cohérence multi-sujets.
Génération conjointe du dialogue, de l’ambiance et des effets avec la vidéo — placez les répliques entre guillemets pour améliorer l’alignement du lip sync.
Choisissez 720p pour des brouillons plus rapides et économiques, ou 1080p pour une livraison plus nette. Les crédits évoluent selon la durée et la qualité sur SeedDance.
Toute durée entière de 3 à 15 secondes (par défaut 5). Facturation linéaire à la seconde — les clips plus longs coûtent proportionnellement plus.
Prise en charge des cadres sociaux et cinématographiques courants : 16:9, 9:16, 1:1, 4:3, 3:4, 4:5, 5:4, 9:21 et 21:9.
Sur SeedDance, HappyHorse 1.1 démarre à 50 crédits pour une génération de 5 secondes en 720p (100 crédits en 1080p) ; image vers vidéo et référence vers vidéo suivent la même courbe de crédits.
Tout ce qu’il faut savoir sur HappyHorse 1.1 sur SeedDance.
Essayez HappyHorse 1.1 d’Alibaba sur SeedDance — génération audio-vidéo conjointe, jusqu’à 9 images de référence, 720p/1080p et clips de 3–15 secondes pour pubs, short drama et storytelling produit.