보정된 희소 어텐션으로 텍스트-투-비디오 생성 가속화
Accelerating Text-to-Video Generation with Calibrated Sparse Attention

TL;DR AI
1분핵심 요약
연구진이 텍스트-투-비디오 확산 모델을 가속하는 무학습 방식 CalibAtt를 공개했다.
오프라인 보정 단계로 안정적인 희소·반복 attention 패턴을 찾고, 추론 시 가치가 낮은 연결을 건너뛴다.
Wan 2.1 14B와 Mochi 1에서 최대 1.58배 속도를 높이면서 품질은 유지했다.
재학습 없이 고해상도·소수 스텝 영상 생성을 더 실용적으로 만든다.
