Kuaishouの次世代Klingモデルは、動画生成、マルチモーダル参照、キーフレーム制御をひとつのエンジンに統合しました。1回で最長30秒、4K 10ビットHDR、より正確なリップシンクのステレオ音声を生成します。Kling 4.0はまもなくSeeVidに登場します。Kling 3.0は今すぐご利用いただけます。
SeeVidで近日公開 — 2026年9月28日発表、2026年10月に正式リリース予定


Kling AIは2026年9月28日にKling 4.0を発表し、完全版モデルを2026年10月にリリースする予定です。従来のバージョンでは、生成・参照・編集が別々のステップでした。Kling 4.0はそれらをひとつの創作モデルに統合し、リアリズム、コントロール、プロ品質の納品という3つの目標を掲げています。実際には、プロンプト1つ、数枚のキーフレーム、または参照素材の組み合わせから、30秒の完成したシーンを生成できます。商品紹介、短いストーリー、SNS広告を、クリップをつなぎ合わせずに作れる長さです。
Kling 4.0はKling 3.0の15秒という上限を2倍にしました。シーン全体で同じカメラワーク、照明、演技が保たれ、ずれていく短いクリップに分割されることはありません。
最大4Kで出力でき、1080pと4Kの両方で10ビットHDRに対応します。チャンネルあたり256ではなく1,024段階の階調があるため、空や肌、夜景のグラデーションがカラーグレーディング後も保たれます。
タイムライン上に最大10枚の画像を配置すると、Kling 4.0がその間の動きを生成します。物語の始まり、転換点、結末はあなたが決め、自然な動きはモデルが補います。
Omni Referenceは1タスクあたり最大15件の素材に対応します。画像最大10枚、動画5本(合計30秒)、被写体7件に加え、被写体ごとの音声参照も使えます。顔、衣装、製品、声が一貫して保たれます。
Kling 4.0が目指すのは、印象的なデモクリップと実際に納品できる映像とのギャップを埋めることです。より長いテイク、より細かな制御、そして本格的なポストプロダクションに合う映像と音声を提供します。

この概要はKling AIの公式発表に基づいています。SeeVidでの具体的なオプション、尺、クレジット消費は、Kling 4.0が生成ツールに追加された時点で確定します。
シーン、カメラワーク、照明、セリフを自然な言葉で記述してください。Kling 4.0がプロンプトを、合ったステレオ音声付きの最長30秒の一貫したクリップにします。
1枚の静止画を動かすことも、最大10枚のキーフレームで構図とタイミングを精密に制御することもできます。絵コンテ、商品の回転ショット、キャラクターの演出に最適です。
画像、短い動画、被写体、声のトーンを組み合わせ、1タスクで最大15件の参照を使えます。キャラクター、製品、ブランドのルックが最初から最後のフレームまで一目でわかります。
10ビットHDRで1080pまたは4Kを出力でき、映画予告編、タイトルシーケンス、ワイド広告向けの21:9ウルトラワイドにも対応します。
セリフ、効果音、環境音を2チャンネルのステレオで生成し、複数の言語で口の動きが音声により正確に合います。
素早い下書き向けの、より軽量で高速なバージョンです。テキストから動画、画像から動画、Omni Referenceに対応し、最長20秒・720p(8ビットSDR)まで生成できます。キーフレームには対応しません。
Kling 4.0と、そのSeeVidへの登場に関するよくある質問です。
Kling 4.0はまもなくSeeVidに登場します。待つ必要はありません。Kling 3.0で始めるか、AI動画生成ツールですべてのモデルを今すぐお試しください。