FLUX 3 — мультимодальный ИИ для видео, изображений и аудиоМультимодальность

Фундаментная модель нового поколения от Black Forest Labs. FLUX 3 обучается на изображениях, видео и аудио вместе — чтобы движение, звук и структура были согласованнее. Создавайте клипы с нативным аудио (часто до ~20 секунд) и продолжайте с изображений или видео, когда видео-тир появится на SeeVid.

Скоро на SeeVid — FLUX 3 Video

Обзор генерации видео FLUX 3

Мультимодальное видео от Black Forest Labs

FLUX 3 — мультимодальная фундаментная модель Black Forest Labs, анонсированная в 2026 году. В отличие от более ранних FLUX, ориентированных на изображения, FLUX 3 обучается совместно на изображениях, видео и аудио в архитектуре Self-Flow. На SeeVid планируемая продуктовая поверхность — FLUX 3 Video (текст, изображение и видео со входами и опциональным нативным аудио).

Видео + нативное аудио

Создавайте разнообразные клипы с синхронизированной речью, эффектами и амбиентом за один проход. Ранние материалы указывают длительность одной генерации обычно до ~20 секунд (разрешение и режим зависят от API провайдера).

Текст, изображение и видео на входе

Начните с промпта (текст→видео), закрепите изображения как кадры (изображение→видео) или продолжите существующий клип (продолжение видео), сохраняя персонажей и контекст.

Вывод 720p и 1080p

Планируемые опции SeeVid включают 720p и 1080p, а также быстрый черновик для итерации промптов перед полным качеством.

Мирно-согласованная генерация

Совместное обучение модальностей рассчитано так, чтобы звук совпадал с ударом, движение уважало структуру, а мультишот-последовательности оставались связнее.

Для согласованного движения, звука и стиля

FLUX 3 ориентирован на авторов и команды, которым нужно больше одного красивого кадра — короткое нарративное видео с аудио и непрерывность по референсам.

Нативное аудио сочетает диалог с ориентацией на lip sync с эффектами и амбиентом, привязанными к физическим событиям — меньше сборки отдельного саундтрека для многих черновиков.

Нативное аудио FLUX 3

Обзор возможностей FLUX 3 Video

Планируемые возможности FLUX 3 Video на SeeVid. Точные опции совпадут с AI-видеогенератором после восстановления модели (длительность, разрешение, черновик, аудио и входы).

Текст→видео

Опишите сцену, камеру, стиль и диалог естественным языком, чтобы получить короткое видео с опциональным нативным аудио.

Изображение→видео

Одно изображение открывает клип пиксель в пиксель; два задают начало и конец; от трёх до десяти — раскадровка (нужна явная длительность). Изображения и start video нельзя совмещать.

Продолжение видео

Загрузите короткий mp4 (≤15 с, ≤50 МБ) как start_video, чтобы продолжить с финальных кадров. Нельзя сочетать с входом изображений.

Черновой превью

Сгенерируйте быстрый дешёвый черновик 720p, чтобы итерировать промпт, затем полный прогон 720p или 1080p.

Синхронизированное аудио

Аудио включено по умолчанию (амбиент, речь, эффекты). Отключите для тихого клипа.

Длительность 5–20 с или Auto

Выберите целое число секунд от 5 до 20 или auto. Раскадровки с тремя и более изображениями требуют явной длительности.

Частые вопросы

Частые вопросы о FLUX 3 и доступности на SeeVid.








FLUX 3 Video скоро на SeeVid

Мы готовим FLUX 3 Video для сценариев текст / изображение / start-video с опциональным нативным аудио. Загляните снова, когда вернётся ранний доступ.