Le modèle multimodal unifié phare de Kuaishou. Sur SeeVid, Kling O3 est disponible aujourd’hui en édition vidéo par instructions (clip source + prompt, images de référence optionnelles) en 720p/1080p. Pour la génération texte/image complète Kling 3.0, utilisez le générateur vidéo IA.
Disponible sur la plateforme SeeVid
Kling O3 — officiellement Kling Video 3.0 Omni — est le modèle phare de la série Kling 3.0 de Kuaishou, lancé le 4 février 2026. Contrairement aux autres générateurs vidéo IA qui nécessitent des outils séparés pour la vidéo, l'audio et le montage, Kling O3 fusionne tout cela dans un système unifié propulsé par l'architecture Omni One. Il intègre le raisonnement visuel en chaîne de pensée (vCoT), la génération audio native, le contrôle storyboard multi-plans jusqu'à 6 coupes caméra et une sortie jusqu'à 4K.
Kling O3 réfléchit avant de rendre. Il décompose votre prompt en éléments de scène, planifie les trajectoires de mouvement, considère l'éclairage et la composition, puis exécute. Ce raisonnement multi-étapes assure la cohérence de scène, la logique caméra et la consistance des objets sur tous les plans.
Une seule génération peut inclure jusqu'à 6 perspectives caméra ou coupes de scène distinctes, chacune avec son propre prompt et sa durée. Passez des plans d'ensemble larges aux gros plans et aux contre-plans — le tout dans une sortie unifiée de jusqu'à 15 secondes.
Dialogues, sons ambiants et musique de fond peuvent être générés avec la vidéo. Les personnages peuvent parler avec des mouvements buccaux, des expressions et des mouvements de tête conçus pour correspondre à l'audio. Prend en charge le code-switching entre plusieurs langues en cours de conversation.
Téléchargez jusqu'à quatre images de référence d'un personnage pour construire un embedding d'identité persistant sur toute votre vidéo. Prend en charge plusieurs personnages simultanés, chacun conservant une apparence et des traits uniques malgré les occlusions, changements d'éclairage et changements de perspective.
Kling O3 vise à réduire les workflows vidéo IA fragmentés en combinant vidéo, audio et direction multi-plans dans un seul système — pour passer moins de temps à assembler des outils séparés et corriger les ruptures de cohérence entre les plans.
Une suite étendue de capacités vidéo IA multimodales — conçue pour les réalisateurs, créateurs, studios et équipes qui ont besoin de vidéo, audio et contrôle multi-plans au même endroit.
Décrivez des scènes multi-plans complexes en langage naturel. Le raisonnement vCoT de Kling O3 comprend le flux narratif, les conventions caméra comme la règle des 180 degrés, le match de regard et le montage de continuité pour produire une sortie cinématographique cohérente.
Animez des images fixes en préservant l'identité du personnage à partir de photos de référence. Prend en charge jusqu'à quatre images de référence par personnage pour des embeddings d'identité stables sur tous les plans et angles caméra.
Spécifiez jusqu'à 6 plans individuels dans une seule génération — chacun avec son propre prompt, durée, taille de plan, perspective et mouvement caméra. Un workflow storyboard-first conçu pour des clips multi-plans en une seule passe.
Générez des dialogues synchronisés, des sons ambiants et de la musique en anglais (accents américain, britannique, indien), chinois (avec dialectes), japonais, coréen et espagnol. Les personnages peuvent alterner entre les langues en cours de conversation.
Générez des vidéos jusqu'à la résolution ultra haute définition 4K. Textures nettes, expressions faciales détaillées et étalonnage couleur cinématographique offrent une sortie de niveau professionnel pour tout écran.
Gravité, équilibre, déformation, collision et inertie sont gérés avec une plausibilité physique plus forte que les versions précédentes. Séquences d'action, clips sportifs et interactions complexes paraissent généralement plus crédibles, bien que les cas difficiles puissent encore montrer des artefacts.
Peignez la direction du mouvement sur des régions spécifiques de l'image avec le Pinceau de mouvement, ou téléchargez une vidéo de référence pour transférer des motifs de mouvement aux personnages et objets avec un contrôle régional fin.
Prolongez tout clip généré vers l'avant ou l'arrière dans le temps en maintenant la continuité visuelle et narrative. Enchaînez plusieurs segments générés par IA pour construire des productions de plusieurs minutes à partir de clips plus courts.
Tout ce que vous devez savoir sur Kling O3 et son utilisation sur SeeVid.
Utilisez Kling O3 sur SeeVid comme éditeur vidéo : importez le clip, décrivez la modification, références optionnelles — sortie 720p/1080p.