Scholay

学术搜索 · AI 审稿 · LaTeX 协作

Towards Diverse and Efficient Audio Captioning via Diffusion Models

作者:Manjie Xu, Chenxing Li, Yong Ren, Xi Tu, Ruibo Fu, Wei Liang, Dong Yu · 年份:2025 · DOI:10.21437/interspeech.2025-79 · 被引用次数:3 · 研究领域:Music and Audio Processing、Subtitles and Audiovisual Media、Speech and Audio Processing