PAPER·May 4, 2026Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion ModelingHugging Face Papers
PAPER·April 20, 2026MINT-Bench: A Comprehensive Multilingual Benchmark for Instruction-Following Text-to-SpeecharXiv