Black Forest Labs의 첫 번째 비디오 모델: 동기화된 오디오가 포함된 20초 클립, 최대 10개의 고정 키프레임, 라이브 액션부터 스톱모션까지 다양한 룩을 제공합니다. 아래에 프롬프트를 입력하고 사용해 보세요.
개발자
Black Forest Labs
유형
멀티모달(동영상은 지금, 이미지는 곧 지원)
오디오
네이티브, 동기화됨, 동일한 비밀번호
기간
패스당 최대 20초
키프레임
최대 10개 고정 + 첫 번째/마지막
가중치 열기
개발 예정, 2026년 말
여기에 등급
유료 크레딧 + 초안 모드
우리의 한 줄 평결: 스토리보드에 적합한 선택. 샷이 반드시 맞춰야 할 프레임을 정확히 알고 있거나, “시네마틱 AI 비디오”가 아닌 룩을 원한다면 여기서 시작하세요.
FLUX 3 Stable Diffusion의 기반 아키텍처를 만든 창립자들의 Freiburg 연구소에서 나왔으며, 그들의 첫 번째 움직이는 모델입니다: 이미지, 비디오, 오디오, 액션을 공동으로 학습한 하나의 네트워크로, 비디오를 먼저 제공합니다. 붐비는 이번 달에 이 모델을 돋보이게 하는 점은 두 가지입니다 — 최대 열 개의 정확한 프레임을 고정하고 모델이 그 사이를 애니메이션으로 이어가게 할 수 있으며, 출력이 번들거리는 “AI 시네마틱” 룩에 갇혀 있지 않습니다. 날것의, 향수를 불러일으키는, 손맛이 있는, 기묘한: 그 폭이 핵심입니다.
테스트 렌더링과 BFL이 공개한 자료를 바탕으로 한 초기 인상입니다 — BFL의 자체 주의 사항도 그대로 전달했습니다. 독립적인 수치가 나오면 수정하겠습니다.
• 키프레임 제어.
최대 10개의 정확한 프레임과 첫 프레임 및 마지막 프레임을 고정하면, 모델이 그 사이의 모션, 카메라, 대화, 오디오를 생성합니다. 입력 형식으로서의 스토리보드 — 저희가 호스팅하는 다른 어떤 것도 이렇게 많은 앵커를 허용하지 않습니다.
• 미적 범위.
스톱모션, 매크로, 타임랩스, 향수를 자아내는 홈비디오, 의도적으로 기묘함 — 대부분의 비디오 모델이 기본적으로 지향하는 획일적인 영화적 광택에서 벗어납니다. 브랜드 룩이 "영화 예고편"이 아니라면, 이는 중요합니다.
• 동일한 패스의 오디오.
동기화된 사운드트랙으로 최대 20초 — 대화 포함 — 그리고 클립을 확장할 때 움직임, 카메라, 오디오를 연결 지점 너머로 이어 주는 이음새 인식 확장 기능.
• 초안 모드의 경제성.
모든 엔드포인트에는 저렴한 미리 보기를 위한 빠른 초안 변형이 있습니다. 초안에서 반복 작업하고, 최종본에만 실제 크레딧을 한 번 사용하세요 — 이 사이트 전체가 강조하는 워크플로가 모델 제품군에 내장되어 있습니다.
• 이미지 부분은 아직 여기에 없습니다.
FLUX라는 이름은 이미지로 유명하지만, FLUX 3의 이미지 생성은 아직 단계적으로 출시 중입니다. 사진을 만들러 오셨다면 아직 몇 주 더 걸립니다 — 크레딧을 써 가며 알아내기 전에 FAQ를 확인하세요.
• 벤치마크는 집 번호입니다.
출시 차트는 초기 후보에 대한 예비 평가로 표시되었고, 가장 화려한 승률은 현재 흐름을 주도하고 있지 않은 모델들을 상대로 나온 것이었다. BFL의 이후 주장은 더 강하지만 여전히 내부 주장이다.
• 20초, 30초가 아닙니다.
Wan 3.0과 Seedance 2.5는 모두 한 번의 패스로 30에 도달합니다. FLUX 3는 이음새를 존중하는 확장으로 응답합니다 — 하지만 요구 사항이 단일한 끊김 없는 30초라면, 적합한 선택은 아닙니다.
• 개발 가중치: 계획됨, 날짜 미정.
오픈 웨이트 릴리스는 날짜나 라이선스 조건 없이 2026년 후반으로 발표되었습니다. BFL의 오픈 소스 이력은 정말 훌륭하지만, 계획은 어디까지나 계획입니다.
모양용 하나, 키프레임용 하나, 이음새용 하나. 복사하고, 괄호를 바꾸고, 렌더링하세요 — 먼저 초안 모드에서.
"손수 만든 스톱모션 장면: 점토 [astronaut]가 밀가루로 만든 주방 식탁 위 달에 작은 종이 깃발을 꽂습니다. 점토에 보이는 지문, 약간 덜컹거리는 12fps 움직임, 부드러운 창가 빛, 펠트 발걸음 소리와 삐걱거리는 목소리의 먹먹한 대사 한 줄."
불완전한 요소들 — 지문, 끊기는 프레임 속도 — 을 구체적으로 지정하는 것이 FLUX 3를 기본적인 광택감에서 벗어나게 합니다. 대부분의 모델은 “수작업”에 저항하지만, 이 모델은 그것을 스타일 목표로 받아들입니다.
업로드: 4개의 키프레임(제품 박스 포장 → 개봉됨 → 손에 든 상태 → 로고 카드)
"20초짜리 언박싱 영상으로, 이 네 장면을 순서대로 약 5초 간격으로 담습니다. 자연스러운 핸드헬드 느낌, 종이를 찢는 소리와 테이프 소리, 세 번째 장면에서 화면 밖 목소리의 조용한 기쁨."
프레임이 구도를 담고 있으므로 프롬프트는 타이밍, 움직임, 사운드만 지시하면 됩니다. 간격 힌트(“대략 5초 간격”)는 모델이 비트를 서두르지 않도록 막아줍니다. 이것이 바로 스토리보드를 우선하는 팀들이 기다려온 워크플로입니다.
시작 위치: 이미 생성한 클립
"10초 연장: [dancer]가 클립이 끝나는 회전을 완료하고, 카메라는 같은 속도로 계속 왼쪽으로 이동하며, 음악은 끊김 없이 계속됩니다 — 컷 없음, 리셋 없음."
확장 기능은 마지막 프레임의 움직임과 오디오를 읽으므로, 지침은 새 장면이 아니라 이어지는 내용을 설명해야 합니다. "클립이 끝나는 지점의 회전을 완성합니다"는 끌어당길 물리적 실마리를 제공합니다; 카메라 속도를 명시하면 이음새를 가로지르는 드리프트가 유지됩니다.
세 가지 오디오 네이티브 모델, 세 가지 제어 철학. 세 모델 모두에 동일한 프롬프트를 사용하고, 우리가 출시할 기준으로 평가했습니다 — 더 새로운 두 모델은 잠정적으로. 직접 비교해 보세요 하나의 프롬프트 상자에서.
7월 23일 발표: 이미지, 비디오, 오디오 및 액션을 위한 하나의 아키텍처. 비디오가 먼저 출시되었습니다(20 s, 네이티브 오디오, 키프레임); 이미지 생성은 이후 몇 주 동안 순차적으로 출시됩니다; 오픈 웨이트 Dev 릴리스는 올해 말로 계획되어 있습니다. 이 페이지의 버전.
그 이름을 알린 이미지 시대: FLUX.1 dev는 어디서나 가장 많이 다운로드되고 파인튜닝된 오픈 디퓨전 릴리스 중 하나가 되었으며, 수많은 커뮤니티 워크플로의 중추가 되었습니다.
창립 팀은 Stable Diffusion의 기반이 된 잠재 확산 아키텍처를 구축했습니다. 그 역사가 가져다주는 오픈소스 신뢰성 때문에 "FLUX 3 Dev"는 대부분의 오픈 웨이트 약속보다 약속으로서 더 큰 무게를 지닙니다.
2026년 7월 23일 발표된 Black Forest Labs의 첫 멀티모달 파운데이션 모델 — Stable Diffusion의 기반 아키텍처를 구축한 창립자들이 속한 프라이부르크 팀이 만든, 이미지, 비디오, 오디오, 액션 예측을 공동으로 학습한 하나의 아키텍처입니다. 오늘 생성에 사용할 수 있는 부분은 비디오입니다: 텍스트, 시작 이미지, 고정된 키프레임 또는 확장하려는 기존 클립에서, 동일한 패스로 동기화된 사운드트랙이 포함된 최대 20초 길이의 비디오를 생성할 수 있습니다.
현실주의자. 클립이 오디오가 포함된 실제 영상처럼 보여야 할 때.
롱테이크. 사운드트랙에 맞춰 편집된 30초 샷.
문서 리더. 덱, PDF 및 스프레드시트를 넣으면 동영상이 나옵니다.