Black Forest Labs, 이미지·비디오·오디오·로봇 행동 예측을 위한 멀티모달 플로우 모델 FLUX 3 공개
Black Forest Labs Releases FLUX 3: A Multimodal Flow Model for Image, Video, Audio and Robot Action Prediction

TL;DR AI
1분핵심 요약
블랙 포레스트 랩스가 이미지·비디오·오디오를 함께 학습한 멀티모달 플로 모델 FLUX 3를 공개했다.
이 모델은 회사의 Self-Flow 방식을 사용하며, 네이티브 오디오가 포함된 최대 20초 영상 생성이 가능하다.
FLUX 3는 비디오 생성과 로봇 행동 예측 기능을 위한 초기 액세스 확장도 제공한다.
이번 출시는 하나의 파운데이션 모델이 다양한 미디어와 체화 AI 작업을 함께 학습할 수 있음을 보여준다.



