Первая видеомодель Black Forest Labs: 20-секундные клипы с синхронизированным звуком, до 10 закреплённых ключевых кадров и визуальные стили от живой съёмки до покадровой анимации. Введите запрос ниже и попробуйте.
Разработчик
Black Forest Labs
Тип
Мультимодальный (видео сейчас, изображения скоро)
Аудио
Нативно, синхронизировано, тот же пароль
Продолжительность
До 20 с за проход
Ключевые кадры
До 10 закрепленных + первый/последний
Открыть веса
Разработка запланирована, конец 2026
Уровень здесь
Платные кредиты + режим черновика
Наш вердикт в одну строку: выбор для раскадровки. Когда вы точно знаете, какие кадры должен включать шот — или хотите добиться вида, который не похож на «кинематографичное AI-видео» — начните здесь.
FLUX 3 появился в лаборатории Фрайбурга, основатели которой создали архитектуру, лежащую в основе Stable Diffusion, и это их первая модель, которая движется: одна сеть, совместно обученная на изображениях, видео, аудио и действиях, сначала выпускающая видео. Две вещи выделяют ее в насыщенном месяце — можно закрепить до десяти точных кадров и позволить модели анимировать переходы между ними, а результат не привязан к глянцевому «кинематографическому ИИ» виду. Сырой, ностальгический, рукотворный, странный: весь смысл в диапазоне.
Первые впечатления от наших тестовых рендеров плюс опубликованные материалы BFL — с их собственными оговорками, переданными без изменений. Мы пересмотрим, когда появятся независимые данные.
• Управление ключевыми кадрами.
Закрепите до 10 точных кадров плюс первый и последний, и модель сгенерирует между ними движение, работу камеры, диалог и аудио. Раскадровка как формат ввода — ничто другое из того, что мы хостим, не принимает столько опорных точек.
• Эстетический диапазон.
Стоп-моушен, макро, таймлапс, ностальгическое домашнее видео, нарочито странное — оно уходит от однообразного кинематографического глянца, к которому по умолчанию стремится большинство видеомоделей. Если визуальный стиль вашего бренда — не "трейлер фильма", это важно.
• Аудио в том же проходе.
До 20 секунд с синхронизированной звуковой дорожкой — включая диалоги — и расширением с учетом шва, которое переносит движение, камеру и аудио через место стыка при удлинении клипа.
• Экономика режима черновика.
У каждой конечной точки есть быстрый черновой вариант для недорогих предварительных просмотров. Дорабатывайте черновик, тратьте реальные кредиты только один раз на финальную версию — рабочий процесс, который пропагандирует весь этот сайт, встроен в семейство моделей.
• Части изображения здесь пока нет.
Название FLUX известно благодаря изображениям, но генерация изображений в FLUX 3 всё ещё запускается постепенно. Если вы пришли сюда создавать картинки, до этого ещё несколько недель — загляните в FAQ, прежде чем потратить кредиты впустую, выясняя это.
• Бенчмарки — это номера домов.
Стартовый график был обозначен как предварительная оценка раннего кандидата, а самые впечатляющие показатели побед были получены против моделей, которые сейчас не задают темп. Более поздние заявления BFL звучат сильнее, но по-прежнему остаются внутренними.
• 20 секунд, не 30.
Wan 3.0 и Seedance 2.5 оба достигают 30 за один проход. FLUX 3 отвечает расширением, которое учитывает шов — но если по брифу нужна единая непрерывная половина минуты, это не лучший выбор.
• Весовые коэффициенты разработки: запланировано, без даты.
Релиз с открытыми весами объявлен на более поздний период 2026 года, без даты или условий лицензии. Репутация BFL в области открытого исходного кода действительно хороша, но план всё равно остаётся планом.
Один для внешнего вида, один для ключевых кадров, один для шва. Скопируйте, поменяйте скобки, выполните рендеринг — сначала в черновом режиме.
"Ручная сцена покадровой анимации: глиняный [astronaut] устанавливает крошечный бумажный флаг на кухонно-стольной луне из муки. Видимые отпечатки пальцев в глине, слегка дерганое движение 12fps, мягкий свет из окна, звуки шагов по фетру и приглушенная реплика писклявым голосом."
Называние несовершенств — отпечатков пальцев, дерганой частоты кадров — вот что уводит FLUX 3 от стандартного глянца. Большинство моделей сопротивляются «ручной работе»; эта воспринимает ее как стилевую цель.
Загрузить: 4 ключевых кадра (товар в коробке → распакован → в руке → карточка с логотипом)
"20-секундное распаковывание, которое последовательно показывает эти четыре кадра, примерно с интервалом в 5 секунд. Естественное ощущение съемки с рук, звуки рвущейся бумаги и скотча, тихая радость в голосе за кадром на третьем кадре."
Кадры несут на себе композицию, поэтому промпту нужно лишь направлять тайминг, движение и звук. Подсказки по интервалам («примерно с интервалом 5 секунд») не дают модели торопить ключевые моменты. Это именно тот рабочий процесс, которого ждали команды, начинающие со сториборда.
Начать с: клип, который вы уже сгенерировали
"Продлить на 10 секунд: [dancer] завершает поворот, на котором заканчивается клип, камера продолжает смещаться влево с той же скоростью, музыка продолжается без заминки — без склейки, без сброса."
Расширение считывает движение и звук в финальных кадрах, поэтому инструкция должна описывать продолжение, а не новую сцену. "Завершает поворот, на котором заканчивается клип" дает ему физическую нить, за которую можно потянуть; указание скорости камеры сохраняет дрейф через стык.
Три аудио-нативные модели, три философии управления. Одни и те же промпты во всех трех, оценка по тому, что мы бы выпустили — предварительно для двух более новых. Сравните их сами из одного поля запроса.
анонсировано 23 июля: единая архитектура для изображений, видео, аудио и действий. Сначала было выпущено видео (20 s, нативный звук, ключевые кадры); генерация изображений будет развертываться в последующие недели; релиз Dev с открытыми весами запланирован на более поздний срок в этом году. Версия на этой странице.
эпоха изображений, которая сделала это имя известным: FLUX.1 dev стал одним из самых скачиваемых и дообучаемых открытых диффузионных релизов в мире, основой бесчисленных рабочих процессов сообщества.
команда основателей создала архитектуру латентной диффузии, лежащую в основе Stable Diffusion. Репутация в open-source, обеспеченная этой историей, — вот почему "FLUX 3 Dev" как обещание имеет больший вес, чем большинство обязательств по открытым весам.
Первая мультимодальная фундаментальная модель Black Forest Labs, анонсированная 23 июля 2026 года — единая архитектура, совместно обученная на изображениях, видео, аудио и прогнозировании действий, от команды из Фрайбурга, основатели которой создали архитектуру, лежащую в основе Stable Diffusion. Часть, с которой вы можете генерировать уже сегодня, — это видео: до 20 секунд с синхронизированной звуковой дорожкой за один проход, из текста, начального изображения, закрепленных ключевых кадров или существующего клипа, который вы хотите продлить.
Реалист. Когда клип должен сойти за реальные кадры, со звуком.
Длинный кадр. 30-секундные кадры, смонтированные под ваш саундтрек.
Программа для чтения документов. Презентации, PDF-файлы и таблицы на входе, видео на выходе.