xAI
Grok Imagine 1.0 Video
От $0.009 за секунду
FLUX 3 — мультимодальная базовая модель Black Forest Labs, обученная на изображениях, видео и аудио в единой архитектуре. Как нейросеть для видео FLUX 3 создаёт картинку и звук вместе — до 20 секунд за одну генерацию — и следует ключевым кадрам, референсным клипам и многоязычным диалогам.
Реальные рабочие процессы и production-сценарии, которые ты можешь собрать и запустить на этой модели.

Текст — это отправная точка, а не весь набор инструкций. Дай FLUX 3 первый кадр для анимации, референсные изображения, которые фиксируют персонажа, исходный клип, элементы которого должны перейти в новую сцену, или два ключевых кадра, задающих начало и конец перехода. FLUX 3 умеет и продолжать существующее видео вместе со звуком, поэтому план можно удлинить, а не генерировать заново.
Читать документацию FLUX 3
FLUX 3 работает с многоязычным диалогом и рисует читаемый текст внутри кадра, поэтому одно креативное решение может переезжать между рынками. Вывески, титры и анимированная типографика создаются как часть сцены, а не накладываются потом, и речевая дорожка рождается вместе с картинкой — именно здесь, по собственным ранним оценкам Black Forest Labs, FLUX 3 уже особенно силён: мимика и многоязычность.

Тот же бэкбон FLUX 3 создаёт и редактирует изображения в разных стилях, пропорциях и разрешениях, а затем разворачивает эти кадры в движение. Форма, цвет, материал и брендинг остаются узнаваемыми между предметной съёмкой и клипом, потому что и то и другое выходит из одной модели, а не из генератора картинок с приставленным сбоку генератором видео.
FLUX 3 учится на изображениях, видео и звуке внутри единой архитектуры, построенной на Self-Flow — подходе Black Forest Labs к согласованию мультимодальной генерации и понимания. Модальности ограничивают друг друга: звук обязан совпасть с ударом, движение обязано подчиняться массе.
Каждый видеовыход FLUX 3 несёт нативное аудио из той же генерации — диалог, атмосфера и удары попадают на тот кадр, которому принадлежат, вместо того чтобы подгоняться по времени к немому материалу постфактум.
FLUX 3 сцепляет отдельные генерации в многокадровые последовательности длиной в минуты, а визуальные референсы удерживают персонажей и локации от сцены к сцене. Двадцать секунд — потолок одной генерации, а не готовой работы.
В собственных ранних оценках Black Forest Labs эти две модели оказались ближе всего друг к другу: зрители предпочли FLUX 3 в 52% сравнений — фактически подбрасывание монеты. Разница в доступности и охвате: Seedance 2.0 вызывается в reAPI прямо сейчас, а FLUX 3 — более широкий мультимодальный фундамент, который ещё раскатывается по этапам.
Сравнение отражает публично задокументированное поведение на момент написания. Показатель 52% взят из предварительной оценки самой Black Forest Labs на 10-секундных клипах 720p со звуком, сгенерированных из текста, для модели, которую компания называет находящейся в разработке; размер выборки и методология не опубликованы, и это не независимый бенчмарк.
Зарегистрируйся в reAPI и сгенерируй ключ. Один ключ, один баланс и одинаковая форма запроса для всех моделей платформы.
ОткрытьСтраница FLUX 3 отслеживает только то, что Black Forest Labs действительно опубликовала — возможности, типы входов и стадию раскатки — и получит эндпоинт, параметры и тарифы, как только их подтвердят.
ОткрытьВидеомодели с нативным звуком уже вызываются в reAPI. Собери интеграцию на одной из них сейчас, а переход на FLUX 3 позже сведётся к id модели и маппингу параметров.
ОткрытьРаспространённые вопросы об этой модели.
Смотрите другие модели той же категории.
xAI
От $0.009 за секунду
PixVerse
От $0.018 за секунду
Topaz Labs
От $0.044 за секунду
ByteDance
От $0.029 за секунду
Попробуй в playground или получи API-ключ для интеграции прямо сейчас.