FLUX 3 — мультимодальный ИИ для видео, изображений и аудиоМультимодальный

Фундаментальная модель нового поколения от Black Forest Labs. FLUX 3 обучается на изображениях, видео и аудио вместе — движение, звук и структура становятся согласованнее. Создавайте клипы с нативным аудио (часто до ~20 секунд), продолжайте с изображений или видео.

Доступно на SeedDance — FLUX 3 Video (ранний доступ)

Мультимодальный обзор FLUX 3

Единый backbone для визуального интеллекта

FLUX 3 — мультимодальная фундаментальная модель Black Forest Labs, анонсированная в 2026 году. В отличие от более ранних FLUX, ориентированных на изображения, FLUX 3 обучается совместно на изображениях, видео и аудио в архитектуре Self-Flow. Продуктовые поверхности выходят как FLUX 3 Video, FLUX 3 Image, FLUX 3 Action и позже FLUX 3 Dev (открытые веса).

Видео + нативное аудио

Создавайте разнообразные клипы с синхронизированной речью, эффектами и амбиентом за один проход. Ранние материалы часто указывают длительность до ~20 секунд (разрешение и режим — по API провайдера).

Ввод текста, изображений и видео

Начните с промпта (текст в видео), закрепите изображения как кадры (изображение в видео) или продолжите клип (продолжение видео), сохраняя персонажей и контекст.

Более сильный синтез изображений

FLUX 3 Image нацелен на лучшее следование сложным промптам и точный многоязычный текст в кадре — ранний доступ после видео-тира.

Генерация, согласованная с миром

Совместное обучение по модальностям рассчитано так, чтобы звук соответствовал удару, движение — структуре, а мультишоты оставались связнее.

Для согласованного движения, звука и стиля

FLUX 3 для создателей и команд, которым нужно больше одного красивого кадра — короткое нарративное видео с аудио, непрерывность по референсам и работа с плотными промптами.

Нативное аудио сочетает диалог с эффектами и амбиентом, связанными с физическими событиями, — меньше нужды собирать отдельный саундтрек на черновиках.

Нативное аудио FLUX 3

Обзор возможностей FLUX 3

Ключевые возможности FLUX 3 Video на SeedDance. Параметры совпадают с AI-видеогенератором (длительность, разрешение, черновик, аудио и входы).

Текст в видео

Опишите сцену, камеру, стиль и диалог естественным языком и получите короткий ролик с опциональным нативным аудио.

Изображение в видео

Одно изображение открывает клип пиксель в пиксель; два задают начало и конец; от трёх до десяти — раскадровка (нужна явная длительность). Изображения и стартовое видео нельзя комбинировать.

Продолжение видео

Загрузите короткий mp4 (≤15 с, ≤50 МБ) как start_video, чтобы продолжить с последних кадров. Несовместимо с входом изображений.

Черновой предпросмотр

Сгенерируйте быстрый и более дешёвый 720p-черновик для итерации промпта, затем полный прогон 720p или 1080p.

Синхронизированное аудио

Аудио включено по умолчанию (амбиент, речь, эффекты). Отключите для беззвучного клипа.

Синтез и редактирование изображений

FLUX 3 Image нацелен на широкий стиль, гибкий кадр и лучший текст на изображении — ранний доступ API после видео-тира.

Частые вопросы

Частые вопросы о FLUX 3 и связанных моделях на SeedDance.








Создавайте с FLUX 3 Video на SeedDance

Откройте AI-видеогенератор, выберите FLUX 3 и создавайте клипы с опциональным нативным аудио — из текста, изображений или стартового видео.