Motor unificado de creación de vídeo de Kuaishou para generar, editar y transformar clips en un sistema — generación por referencia, edición en lenguaje natural, consistencia multi-sujeto y combinaciones de habilidades. Esta página es una introducción en SeeVid.
No disponible en el selector de SeeVid — esta página presenta la serie Kling O1
Lanzado el 1 de diciembre de 2025, Kling O1 es el modelo temprano de creación de vídeo multimodal unificado de Kuaishou. Construido sobre el framework Multimodal Visual Language (MVL), combina generación por referencia, texto-a-video, control de fotograma inicial/final, in-painting, edición, re-renderizado de estilo y extensión de tomas en un motor — buscando reducir el cambio entre herramientas en el ciclo creativo.
Siete tareas de video integradas en una plataforma: texto-a-video, imagen-a-video, generación basada en referencia, control de fotograma inicial/final, in-painting de video, re-renderizado de estilo y extensión de tomas. Todo el ciclo de vida creativo desde la concepción hasta el refinamiento es un flujo de trabajo único y continuo.
Kling O1 busca retener la identidad de personajes principales, utilería y escenarios entre tomas. La consistencia es un foco en movimientos de cámara, cambios de luz y escenas grupales, aunque los casos difíciles aún pueden variar.
Edita videos conversacionalmente: escribe 'elimina transeúntes' o 'transiciona de día a atardecer' y Kling O1 intenta reconstrucción semántica — desde reemplazo de sujeto hasta re-renderizado de estilo — sin exigir máscaras o keyframes en muchos casos.
Ejecuta operaciones creativas compuestas simultáneamente: inserta un sujeto mientras modificas el fondo, genera desde una imagen de referencia mientras cambias el estilo artístico. Tareas que previamente requerían múltiples herramientas ahora ocurren en una sola pasada de generación.
Kling O1 se centra en un dolor común del vídeo IA — inconsistencia de personajes y escenas — y combina tareas de generación y edición en un sistema.
Siete capacidades de creación de video integradas unificadas en un único sistema IA — para cine, televisión, redes sociales, publicidad y e-commerce.
Genera clips de video cinematográficos desde descripciones en lenguaje natural. La comprensión semántica profunda de Kling O1 produce resultados coherentes y visualmente consistentes para prompts narrativos complejos.
Sube imágenes de referencia para fijar los rasgos visuales únicos de un personaje y genera escenas completamente nuevas con ese personaje consistentemente preservado. Soporta múltiples sujetos de referencia simultáneos.
Define tanto el fotograma de apertura como el de cierre de tu video — Kling O1 completa inteligentemente el movimiento y la narrativa entre ellos, dándote control preciso sobre el arco de cada clip.
Inserta nuevos sujetos o elimina elementos no deseados de video existente con comandos de lenguaje natural. Kling O1 admite reconstrucción semántica sin exigir máscaras manuales en muchos flujos.
Edita material existente conversacionalmente: cambia fondos, intercambia vestimenta, altera hora del día, modifica utilería — todo describiendo el cambio en texto plano. No se requiere keyframing o edición manual.
Aplica diferentes estilos artísticos a videos existentes — desde fotorrealista a anime, film noir a acuarela — manteniendo el movimiento y composición originales.
Extiende cualquier clip de video hacia adelante o atrás manteniendo completa continuidad visual y narrativa. Encadena múltiples clips para construir producciones más largas desde segmentos generados por IA.
Ejecuta múltiples tareas creativas simultáneamente en una sola pasada: inserta un sujeto + modifica fondo, o genera desde referencia + cambia estilo. Flujos de trabajo complejos multi-paso comprimidos en un prompt.
Todo lo que necesitas saber sobre Kling O1 y cómo usarlo en SeeVid.