view article Article YODAS v3: A 1 Million Hour Dataset for the Next Generation of Open Voice AI Research espnet • 2 days ago • 22
ExposeAnyone: Personalized Audio-to-Expression Diffusion Models Are Robust Zero-Shot Face Forgery Detectors Paper • 2601.02359 • Published Jan 5 • 6
Reference-Driven Multi-Speaker Audio Scene Generation from In-the-Wild Priors Paper • 2606.19325 • Published Jun 17 • 2