Scholay

学术搜索 · AI 审稿 · LaTeX 协作

Zhiyong Yan

机构:Xiaomi (China)

发表论文 25 篇 · 总被引 416 次 · h-index 9

代表论文

  • GigaSpeech: An Evolving, Multi-Domain ASR Corpus with 10,000 Hours of Transcribed Audio (2021 · 被引 210)
  • speechocean762: An Open-Source Non-Native English Speech Corpus for Pronunciation Assessment (2021 · 被引 62)
  • CED: Consistent Ensemble Distillation for Audio Tagging (2024 · 被引 26)
  • Av-Sepformer: Cross-Attention Sepformer for Audio-Visual Target Speaker Extraction (2023 · 被引 22)
  • GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio (2021 · arXiv (Cornell University) · 被引 20)
  • Scaling up masked audio encoder learning for general audio classification (2024 · 被引 19)