언어 바꾸기English
이전 목록

보정된 희소 어텐션으로 텍스트-투-비디오 생성 가속화

Accelerating Text-to-Video Generation with Calibrated Sparse Attention

TL;DR AI

핵심 요약

1분
  1. 연구진이 텍스트-투-비디오 확산 모델을 가속하는 무학습 방식 CalibAtt를 공개했다.

  2. 오프라인 보정 단계로 안정적인 희소·반복 attention 패턴을 찾고, 추론 시 가치가 낮은 연결을 건너뛴다.

  3. Wan 2.1 14B와 Mochi 1에서 최대 1.58배 속도를 높이면서 품질은 유지했다.

  4. 재학습 없이 고해상도·소수 스텝 영상 생성을 더 실용적으로 만든다.

원문 보기