Первая видеомодель Black Forest Labs: 20-секундные клипы с синхронизированным звуком, до 10 закреплённых ключевых кадров и визуальные стили от живой съёмки до покадровой анимации. Введите запрос ниже и попробуйте.
Разработчик
Black Forest Labs
Тип
Мультимодальный (видео сейчас, изображения скоро)
Аудио
Нативно, синхронизировано, тот же пароль
Продолжительность
До 20 с за проход
Ключевые кадры
До 10 закрепленных + первый/последний
Открыть веса
Разработка запланирована, конец 2026
Уровень здесь
Платные кредиты + режим черновика
Наш вердикт в одну строку: выбор для раскадровки. Когда вы точно знаете, какие кадры должен включать шот — или хотите добиться вида, который не похож на «кинематографичное AI-видео» — начните здесь.
FLUX 3 появился в лаборатории Фрайбурга, основатели которой создали архитектуру, лежащую в основе Stable Diffusion, и это их первая модель, которая движется: одна сеть, совместно обученная на изображениях, видео, аудио и действиях, сначала выпускающая видео. Две вещи выделяют ее в насыщенном месяце — можно закрепить до десяти точных кадров и позволить модели анимировать переходы между ними, а результат не привязан к глянцевому «кинематографическому ИИ» виду. Сырой, ностальгический, рукотворный, странный: весь смысл в диапазоне.
Первые впечатления от наших тестовых рендеров плюс опубликованные материалы BFL — с их собственными оговорками, переданными без изменений. Мы пересмотрим, когда появятся независимые данные.
• Управление ключевыми кадрами.
Закрепите до 10 точных кадров плюс первый и последний, и модель сгенерирует между ними движение, работу камеры, диалог и аудио. Раскадровка как формат ввода — ничто другое из того, что мы хостим, не принимает столько опорных точек.
• Эстетический диапазон.
Стоп-моушен, макро, таймлапс, ностальгическое домашнее видео, нарочито странное — оно уходит от однообразного кинематографического глянца, к которому по умолчанию стремится большинство видеомоделей. Если визуальный стиль вашего бренда — не "трейлер фильма", это важно.
• Аудио в том же проходе.
До 20 секунд с синхронизированной звуковой дорожкой — включая диалоги — и расширением с учетом шва, которое переносит движение, камеру и аудио через место стыка при удлинении клипа.
• Экономика режима черновика.
У каждой конечной точки есть быстрый черновой вариант для недорогих предварительных просмотров. Дорабатывайте черновик, тратьте реальные кредиты только один раз на финальную версию — рабочий процесс, который пропагандирует весь этот сайт, встроен в семейство моделей.
• Части изображения здесь пока нет.
Название FLUX известно благодаря изображениям, но генерация изображений в FLUX 3 всё ещё запускается постепенно. Если вы пришли сюда создавать картинки, до этого ещё несколько недель — загляните в FAQ, прежде чем потратить кредиты впустую, выясняя это.
• Бенчмарки — это номера домов.
Стартовый график был обозначен как предварительная оценка раннего кандидата, а самые впечатляющие показатели побед были получены против моделей, которые сейчас не задают темп. Более поздние заявления BFL звучат сильнее, но по-прежнему остаются внутренними.
• 20 секунд, не 30.
Wan 3.0 и Seedance 2.5 оба достигают 30 за один проход. FLUX 3 отвечает расширением, которое учитывает шов — но если по брифу нужна единая непрерывная половина минуты, это не лучший выбор.
• Весовые коэффициенты разработки: запланировано, без даты.
Релиз с открытыми весами объявлен на более поздний период 2026 года, без даты или условий лицензии. Репутация BFL в области открытого исходного кода действительно хороша, но план всё равно остаётся планом.
Один для внешнего вида, один для ключевых кадров, один для шва. Скопируйте, поменяйте скобки, выполните рендеринг — сначала в черновом режиме.
"Ручная сцена покадровой анимации: глиняный [astronaut] устанавливает крошечный бумажный флаг на кухонно-стольной луне из муки. Видимые отпечатки пальцев в глине, слегка дерганое движение 12fps, мягкий свет из окна, звуки шагов по фетру и приглушенная реплика писклявым голосом."
Называние несовершенств — отпечатков пальцев, дерганой частоты кадров — вот что уводит FLUX 3 от стандартного глянца. Большинство моделей сопротивляются «ручной работе»; эта воспринимает ее как стилевую цель.
Загрузить: 4 ключевых кадра (товар в коробке → распакован → в руке → карточка с логотипом)
"20-секундное распаковывание, которое последовательно показывает эти четыре кадра, примерно с интервалом в 5 секунд. Естественное ощущение съемки с рук, звуки рвущейся бумаги и скотча, тихая радость в голосе за кадром на третьем кадре."
Кадры несут на себе композицию, поэтому промпту нужно лишь направлять тайминг, движение и звук. Подсказки по интервалам («примерно с интервалом 5 секунд») не дают модели торопить ключевые моменты. Это именно тот рабочий процесс, которого ждали команды, начинающие со сториборда.
Начать с: клип, который вы уже сгенерировали
"Продлить на 10 секунд: [dancer] завершает поворот, на котором заканчивается клип, камера продолжает смещаться влево с той же скоростью, музыка продолжается без заминки — без склейки, без сброса."
Расширение считывает движение и звук в финальных кадрах, поэтому инструкция должна описывать продолжение, а не новую сцену. "Завершает поворот, на котором заканчивается клип" дает ему физическую нить, за которую можно потянуть; указание скорости камеры сохраняет дрейф через стык.
Три аудио-нативные модели, три философии управления. Одни и те же промпты во всех трех, оценка по тому, что мы бы выпустили — предварительно для двух более новых. Сравните их сами из одного поля запроса.
анонсировано 23 июля: единая архитектура для изображений, видео, аудио и действий. Сначала было выпущено видео (20 s, нативный звук, ключевые кадры); генерация изображений будет развертываться в последующие недели; релиз Dev с открытыми весами запланирован на более поздний срок в этом году. Версия на этой странице.
эпоха изображений, которая сделала это имя известным: FLUX.1 dev стал одним из самых скачиваемых и дообучаемых открытых диффузионных релизов в мире, основой бесчисленных рабочих процессов сообщества.
команда основателей создала архитектуру латентной диффузии, лежащую в основе Stable Diffusion. Репутация в open-source, обеспеченная этой историей, — вот почему "FLUX 3 Dev" как обещание имеет больший вес, чем большинство обязательств по открытым весам.
Первая мультимодальная фундаментальная модель Black Forest Labs, анонсированная 23 июля 2026 года — единая архитектура, совместно обученная на изображениях, видео, аудио и прогнозировании действий, от команды из Фрайбурга, основатели которой создали архитектуру, лежащую в основе Stable Diffusion. Часть, с которой вы можете генерировать уже сегодня, — это видео: до 20 секунд с синхронизированной звуковой дорожкой за один проход, из текста, начального изображения, закрепленных ключевых кадров или существующего клипа, который вы хотите продлить.