PAPER·10 hours agoDistillAlign: Coordinating Mode Covering and Mode Seeking in Autoregressive Video DistillationHugging Face Papers
PAPER·2 days agoParallel Decoding Distillation for Fast Image and Video GenerationHugging Face Papers
PAPER·3 days agoSol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention SparsificationHugging Face Papers
PAPER·3 days agoOmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint GenerationHugging Face Papers
TECH·4 days agoBlack Forest Labs Releases FLUX 3: A Multimodal Flow Model for Image, Video, Audio and Robot Action PredictionMarkTechPost
PAPER·July 24, 2026AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation AlignmentarXiv
PAPER·July 24, 2026SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video GenerationHugging Face Papers
PAPER·July 21, 2026Accelerating Text-to-Video Generation with Calibrated Sparse AttentionApple Machine Learning Research
PAPER·June 2, 2026LongLive-RAG: A General Retrieval-Augmented Framework for Long Video GenerationHugging Face Papers
PAPER·June 2, 2026VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time OptimizationHugging Face Papers