PAPER·22 hours agoSol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention SparsificationHugging Face Papers
PAPER·May 28, 2026GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-PreserverarXiv
PAPER·May 27, 2026RT-Lynx: Putting GEMM Sparsity in the Right Way for Diffusion ModelsHugging Face Papers
PAPER·May 25, 2026Rethinking Cross-Layer Information Routing in Diffusion TransformersHugging Face Papers
PAPER·May 25, 2026SCOPE: Simulating Cross-game Operations in Playable Environments for FPS World ModelsHugging Face Papers
PAPER·May 22, 2026SEGA: Spectral-Energy Guided Attention for Resolution Extrapolation in Diffusion TransformersHugging Face Papers
PAPER·May 22, 2026RiT: Vanilla Diffusion Transformers Suffice in Representation SpaceHugging Face Papers
PAPER·May 14, 2026TrackCraft3R: Repurposing Video Diffusion Transformers for Dense 3D TrackingHugging Face Papers
PAPER·May 11, 2026Mean Mode Screaming: Mean-Variance Split Residuals for 1000-Layer Diffusion TransformersHugging Face Papers
PAPER·April 8, 2026Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet SupervisionHugging Face Papers