PAPER·3 days agoParallel Decoding Distillation for Fast Image and Video GenerationHugging Face Papers
PAPER·5 days agoTaoMate: Anchor-Guided Memory Bridging Evolving and Reference States for Real-Time Audio-Video Digital Human GenerationarXiv
TECH·6 days agoBlack Forest Labs Releases FLUX 3: A Multimodal Flow Model for Image, Video, Audio and Robot Action PredictionMarkTechPost
PAPER·July 24, 2026AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation AlignmentarXiv
PAPER·July 21, 2026Accelerating Text-to-Video Generation with Calibrated Sparse AttentionApple Machine Learning Research
PAPER·June 2, 2026LongLive-RAG: A General Retrieval-Augmented Framework for Long Video GenerationHugging Face Papers
PAPER·June 2, 2026LongLive-RAG: A General Retrieval-Augmented Framework for Long Video GenerationarXiv
PAPER·June 1, 2026Lumos-Nexus: Efficient Frequency Bridging with Homogeneous Latent Space for Video Unified ModelsHugging Face Papers
PAPER·May 30, 2026Lumos-Nexus: Efficient Frequency Bridging with Homogeneous Latent Space for Video Unified ModelsarXiv