Towards Diverse and Efficient Audio Captioning via Diffusion Models
作者:Manjie Xu, Chenxing Li, Yong Ren, Xi Tu, Ruibo Fu, Wei Liang, Dong Yu · 年份:2025 · DOI:10.21437/interspeech.2025-79 · 被引用次数:3 · 研究领域:Music and Audio Processing、Subtitles and Audiovisual Media、Speech and Audio Processing