FlowLong: 다양체 제약 Tweedie 매칭을 통한 추론 시 장편 비디오 생성
FlowLong: Inference-time Long Video Generation via Manifold-constrained Tweedie Matching
TL;DR AI
1분핵심 요약
연구진은 추가 학습 없이 훨씬 더 긴 영상 생성을 가능하게 하는 추론 전용 방법 FlowLong을 제안했다.
겹치는 슬라이딩 윈도우 예측을 Tweedie matching으로 이어 붙여 시간적 일관성과 시각적 안정성을 유지한다.
초기에는 확률적 샘플링을, 이후에는 결정적 샘플링을 사용해 장기 생성에서 드리프트를 줄이고 품질을 높인다.
FlowLong은 특정 구조에 의존하지 않아 다양한 비디오 확산 모델의 길이를 확장할 수 있으며, 오디오-비디오 및 text-to-3DGS에도 적용된다.
