PAPER·yesterdayWorldDiT: A Unified Diffusion Architecture for World and Action ModelingHugging Face Papers
PAPER·yesterdaySol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention SparsificationHugging Face Papers
PAPER·2 days agoMemory Efficient Audio Synthesis with Decoupled Temporal Depth Diffusion TransformersApple Machine Learning Research
PAPER·5 days agoSANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video GenerationHugging Face Papers
PAPER·June 1, 2026Towards Streaming Synchronized Spatial Audio Generation via Autoregressive Diffusion TransformerHugging Face Papers
PAPER·June 1, 2026SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion TransformerHugging Face Papers
PAPER·May 27, 2026RT-Lynx: Putting GEMM Sparsity in the Right Way for Diffusion ModelsHugging Face Papers
PAPER·May 25, 2026Rethinking Cross-Layer Information Routing in Diffusion TransformersHugging Face Papers
PAPER·May 25, 2026SCOPE: Simulating Cross-game Operations in Playable Environments for FPS World ModelsHugging Face Papers
PAPER·May 22, 2026SEGA: Spectral-Energy Guided Attention for Resolution Extrapolation in Diffusion TransformersHugging Face Papers