Black Forest Labs анонсировала FLUX 3 — мультимодальную ИИ-модель, обученную на изображениях, видео и аудио. Сначала компания открыла ранний доступ к FLUX 3 Video — модели, которая генерирует видео сразу со звуком.
Black Forest Labs выдаёт доступ по заявке и при отборе учитывает задачи пользователя или компании. Подробнее о новой модели — в материале Postium.
Читайте также: 7 лучших нейросетей для генерации видео
Что умеет нейросеть FLUX 3 Video
FLUX 3 Video генерирует видео со звуком продолжительностью до 20 секунд за один запрос. Модель принимает текстовые запросы, изображения и исходные видеоролики.
Можно анимировать исходный кадр, использовать изображение как визуальный референс, перенести персонажа или другой центральный объект из исходного ролика в новую сцену, продолжить видео вместе со звуком либо задать ключевые кадры для переходов между сценами. Модель поддерживает многоязычные диалоги, разные соотношения сторон и анимированный текст. Несколько клипов можно генерировать последовательно, чтобы получить более длинный ролик.
Black Forest Labs также показала результаты ранних тестов. В сравнении 10-секундных роликов в 720p со звуком участники чаще выбирали FLUX 3, чем Grok Imagine Video, Kling v3 Pro, Seedance 2.0, Gemini Omni Flash, Runway Gen-4.5 и Luma Ray 3.2.
FLUX 3 также умеет создавать и редактировать изображения. Доступ к FLUX 3 Image компания планирует открыть в ближайшие недели. Позже Black Forest Labs собирается открыть API и предоставить приватные веса для генерации и редактирования видео, аудио и изображений.
Как получить доступ и пользоваться нейросетью
Сейчас доступна только ранняя версия FLUX 3 Video. Чтобы попасть в тестирование, нужно заполнить заявку на сайте Black Forest Labs. Компания бесплатно открывает доступ выбранным участникам и оценивает заявки по описанию того, как они планируют использовать модель.
Публичного API, цен и собственного интерфейса для FLUX 3 пока нет. Black Forest Labs обещает открыть API и предоставить приватные веса для генерации и редактирования видео со звуком в ближайшие недели и месяцы. Отдельный ранний доступ к FLUX 3 Image появится позже.
После получения доступа можно создавать ролики продолжительностью до 20 секунд по тексту, изображению, исходному видео или ключевым кадрам. Модель генерирует звук одновременно с видео, продолжает исходный ролик и переносит персонажа или другой объект из референса в новую сцену.
Что это меняет? Раньше линейка FLUX была ориентирована на генерацию и редактирование изображений. Теперь FLUX 3 работает с видео, звуком и визуальными референсами в одной архитектуре. Позже компания планирует использовать эту архитектуру для предсказания действий роботов.
Напомним, предыдущая версия модели — FLUX.2 — вышла в ноябре 2025 года и была ориентирована на генерацию и редактирование изображений. В FLUX 3 компания расширила линейку: модель работает не только с картинками, но также с видео и звуком.
Для робототехники Black Forest Labs совместно с mimic robotics разработала модель FLUX-mimic на базе FLUX 3. По данным компании, её уже тестируют и внедряют в производственных задачах Audi.
Итог: Сейчас можно подать заявку только на ранний доступ к FLUX 3 Video. Доступ к FLUX 3 Image, API и открытым весам компания будет открывать поэтапно.





