PAPER·May 29, 2026YoCausal: How Far is Video Generation from World Model? A Causality PerspectiveHugging Face Papers
PAPER·May 29, 2026minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World ModelsHugging Face Papers
PAPER·May 29, 2026MoZoo: Unleashing Video Diffusion Power in Animal Fur and Muscle SimulationHugging Face Papers
PAPER·May 29, 2026minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World ModelsarXiv
PAPER·May 28, 2026Alignment-Guided Score Matching for Text-to-Image Alignment in Diffusion ModelsarXiv
PAPER·May 28, 2026Balancing Fidelity and Diversity in Diffusion Models via Symmetric Attention Decomposition: Hopfield PerspectiveHugging Face Papers
PAPER·May 27, 2026Squeezing Capacity from Multimodal Large Language Models for Subject-driven GenerationHugging Face Papers
PAPER·May 27, 2026RT-Lynx: Putting GEMM Sparsity in the Right Way for Diffusion ModelsHugging Face Papers
TECH·May 27, 2026Stability AI Releases Stable Audio 3: A Family of Fast Latent Diffusion Models for Audio Generation and EditingMarkTechPost
PAPER·May 26, 2026Injecting Image Guidance into Text-Conditioned Diffusion Models at InferenceHugging Face Papers
PAPER·May 26, 2026Localizing Memorized Regions in Diffusion Models via Coordinate-Wise Curvature DifferencesarXiv