PAPER·yesterdaySol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention SparsificationHugging Face Papers
PAPER·May 28, 2026GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-PreserverarXiv
PAPER·May 27, 2026RT-Lynx: Putting GEMM Sparsity in the Right Way for Diffusion ModelsHugging Face Papers
PAPER·May 25, 2026Rethinking Cross-Layer Information Routing in Diffusion TransformersHugging Face Papers
PAPER·May 25, 2026SCOPE: Simulating Cross-game Operations in Playable Environments for FPS World ModelsHugging Face Papers
PAPER·May 22, 2026SEGA: Spectral-Energy Guided Attention for Resolution Extrapolation in Diffusion TransformersHugging Face Papers
PAPER·May 11, 2026Mean Mode Screaming: Mean-Variance Split Residuals for 1000-Layer Diffusion TransformersHugging Face Papers
PAPER·April 8, 2026Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet SupervisionHugging Face Papers
PAPER·April 2, 2026MPDiT: Multi-Patch Global-to-Local Transformer Architecture For Efficient Flow Matching and Diffusion ModelHugging Face Papers
PAPER·March 31, 2026On-the-fly Repulsion in the Contextual Space for Rich Diversity in Diffusion TransformersHugging Face Papers
PAPER·March 27, 2026Calibri: Enhancing Diffusion Transformers via Parameter-Efficient CalibrationHugging Face Papers