PAPER·5 hours agoChimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion TransformersHugging Face Papers
PAPER·2 days agoDistillAlign: Coordinating Mode Covering and Mode Seeking in Autoregressive Video DistillationHugging Face Papers
PAPER·3 days agoParallel Decoding Distillation for Fast Image and Video GenerationHugging Face Papers
PAPER·5 days agoTaoMate: Anchor-Guided Memory Bridging Evolving and Reference States for Real-Time Audio-Video Digital Human GenerationarXiv
PAPER·July 24, 2026AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation AlignmentarXiv
PAPER·July 21, 2026Accelerating Text-to-Video Generation with Calibrated Sparse AttentionApple Machine Learning Research
PAPER·June 2, 2026LongLive-RAG: A General Retrieval-Augmented Framework for Long Video GenerationHugging Face Papers
PAPER·June 2, 2026LongLive-RAG: A General Retrieval-Augmented Framework for Long Video GenerationarXiv