Kuaishous vereinheitlichte Videoerstellungs-Engine zum Generieren, Bearbeiten und Transformieren von Clips in einem System — referenzbasierte Generierung, natürlichsprachliche Bearbeitung, Multi-Subjekt-Konsistenz und Skill-Kombos. Diese Seite ist eine Einführung auf SeeVid.
Im SeeVid-Modellselektor nicht verfügbar — diese Seite stellt die Kling-O1-Serie vor
Kling O1 wurde am 1. Dezember 2025 veröffentlicht und ist Kuaishous frühes vereinheitlichtes multimodales Videoerstellungsmodell. Auf dem Multimodal Visual Language (MVL)-Framework aufgebaut, vereint es referenzbasierte Generierung, Text-zu-Video, Start-/Endframe-Steuerung, Video-In-Painting, Videobearbeitung, Stil-Neurendering und Shot-Erweiterung in einer Engine — mit dem Ziel, Tool-Wechsel im kreativen Lebenszyklus zu reduzieren.
Sieben Videoaufgaben in einer Plattform integriert: Text-zu-Video, Bild-zu-Video, referenzbasierte Generierung, Start-/Endframe-Steuerung, Video-In-Painting, Stil-Neurendering und Shot-Erweiterung. Der gesamte kreative Lebenszyklus von der Idee bis zur Feinabstimmung ist ein nahtloser Single-Stream-Workflow.
Kling O1 zielt darauf ab, die Identität von Hauptfiguren, Requisiten und Settings über Einstellungen hinweg zu bewahren. Konsistenz ist ein zentraler Fokus bei Kamerabewegungen, Lichtwechseln und Gruppenszenen, auch wenn schwierige Fälle noch variieren können.
Videos im Dialog bearbeiten: Geben Sie „Passanten entfernen“, „Tag zu Dämmerung überblenden“ oder „Kleidung des Protagonisten tauschen“ ein — Kling O1 versucht semantische Rekonstruktion — von Subjektersatz bis Stil-Neurendering — oft ohne manuelles Maskieren oder Keyframing.
Zusammengesetzte kreative Operationen gleichzeitig ausführen: Subjekt einfügen und Hintergrund ändern, aus Referenzbild generieren und künstlerischen Stil wechseln. Aufgaben, die früher mehrere Tools erforderten, laufen jetzt in einem einzigen Generierungsdurchgang.
Kling O1 adressiert einen häufigen Schmerzpunkt bei KI-Video — Charakter- und Szeneninkonsistenz — und kombiniert Generierungs- und Bearbeitungsaufgaben in einem System.
Sieben integrierte Videoerstellungsfähigkeiten in einem KI-System vereint — für Film, Fernsehen, Social Media, Werbung und E-Commerce.
Kinoreife Videoclips aus natürlichsprachlichen Beschreibungen generieren. Kling O1s tiefes semantisches Verständnis liefert kohärente, visuell konsistente Ergebnisse für komplexe narrative Prompts.
Referenzbilder hochladen, um einzigartige visuelle Merkmale einer Figur zu fixieren, und völlig neue Szenen generieren, in denen diese Figur konsistent erhalten bleibt. Unterstützt mehrere gleichzeitige Referenzsubjekte.
Eröffnungs- und Schlussframe Ihres Videos definieren — Kling O1 füllt intelligent Bewegung und Erzählung dazwischen aus und gibt Ihnen präzise Kontrolle über den Bogen jedes Clips.
Neue Subjekte einfügen oder unerwünschte Elemente aus bestehendem Video mit natürlichsprachlichen Befehlen entfernen. Kling O1 unterstützt semantische Rekonstruktion ohne manuelles Maskieren in vielen Workflows.
Bestehendes Material im Dialog bearbeiten: Hintergründe ändern, Outfits tauschen, Tageszeit anpassen, Requisiten modifizieren — alles durch Beschreibung in Klartext. Kein Keyframing oder manuelle Bearbeitung nötig.
Verschiedene künstlerische Stile auf bestehende Videos anwenden — von fotorealistisch bis Anime, Film Noir bis Aquarell — bei Beibehaltung der ursprünglichen Bewegung und Komposition.
Jeden Videoclip vorwärts oder rückwärts erweitern bei vollständiger visueller und narrativer Kontinuität. Mehrere Clips verketten, um längere Produktionen aus KI-generierten Segmenten zu bauen.
Mehrere kreative Aufgaben gleichzeitig in einem Durchgang ausführen: Subjekt einfügen + Hintergrund ändern oder aus Referenz generieren + Stil wechseln. Komplexe mehrstufige Workflows in einem Prompt komprimiert.
Alles, was Sie über Kling O1 und die Nutzung auf SeeVid wissen müssen.