SeeVid の xAI Grok Imagine Video。テキストや画像から生成、または参照画像2–7枚でガイド——1–15秒、480p/720p、同期オーディオと物理的な動き。
SeeVidプラットフォームで利用可能

Grok Imagine Video は xAI の Aurora エンジン動画モデルです。SeeVid では文生・図生・参照生(画像2–7枚)に対応——長さ1–15秒(デフォルト6)、480p/720p、ネイティブ同期オーディオ。
xAIのAuroraエンジンに基づき、より現実的な動きを実現——物体の相互作用、重力、運動量、環境効果がクリップ全体で物理的により一貫して感じられます。
音声は動画と同時に一回のパスで生成——環境音、効果音、対話の手がかりが画面上のアクションに合わせてタイミング調整され、別途の吹き替え工程は不要です。
24 FPSで出力し、滑らかで映画のような時間的一貫性を実現。短いシネマティッククリップやソーシャル向けクリップに適しています。
詳細なテキストプロンプトから生成、静止画に動きを付与、または参照動画をアップロードして編集風の変換を行い、核心的な動きの構造を保ちます。
長さ・解像度・アスペクト比の選択肢が明確な、実用的な生成・編集ワークフロー。

SeeVidのAI動画ジェネレーターで公開されているGrok Imagine Videoの機能。
テキストプロンプトを1–15秒のシネマティッククリップに変換。シーン、カメラ、スタイル、動きを自然言語で記述できます。
静止画に自然で物理的に根拠のある動きを付与し、ソースの視覚的アイデンティティの保持を目指します。
参照動画とプロンプトをアップロードしてクリップを再スタイルまたは変換。SeeVidではソースの長さは画像2–7枚までです。
音声は動画と同時に一回のパスで共同生成——環境音、効果音、対話の手がかりが映像に合わせてタイミング調整されます。
短いシネマティックおよびソーシャルコンテンツ向けの、プロフェッショナル感のある24 FPSの動き。
重力、運動量、衝突、流体、環境効果の物理感シミュレーションにより、より説得力のある動きをサポートします。
パン、チルト、ズーム、トラッキングなどのカメラ動作をプロンプトで直接指定できます。
SeeVidでは auto、16:9、9:16、1:1、4:3、3:4、3:2、2:3 に対応し、横向き・縦向き・正方形をカバーします。
SeeVid上のGrok Imagine Videoについて知っておくべきこと。
SeeVidでGrok Imagine Videoを試す——テキストから動画、画像から動画、参照動画生成(画像2–7枚)、ネイティブ音声、1–15秒のクリップ、480p / 720p出力。