PAPER·yesterdayChimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion TransformersHugging Face Papers
PAPER·3 days agoWorldDiT: A Unified Diffusion Architecture for World and Action ModelingHugging Face Papers
PAPER·3 days agoSol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention SparsificationHugging Face Papers
PAPER·3 days agoMemory Efficient Audio Synthesis with Decoupled Temporal Depth Diffusion TransformersApple Machine Learning Research
PAPER·July 24, 2026TRaM-VSR: Importance-Aware Token Routing and Merging for One-Step Diffusion Video Super-ResolutionarXiv
PAPER·May 28, 2026GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-PreserverarXiv
PAPER·May 27, 2026RT-Lynx: Putting GEMM Sparsity in the Right Way for Diffusion ModelsHugging Face Papers
PAPER·May 22, 2026RiT: Vanilla Diffusion Transformers Suffice in Representation SpaceHugging Face Papers
PAPER·May 15, 2026DreamSR: Towards Ultra-High-Resolution Image Super-Resolution via a Receptive-Field Enhanced Diffusion TransformerarXiv
PAPER·April 17, 2026OneHOI: Unifying Human-Object Interaction Generation and EditingHugging Face Papers