Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Shuaijiang Zhao — most-cited papers & profile · Speech Audio
← authors
·
overview
Shuaijiang Zhao
7
papers ·
254
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio
2021 · 201 citations
Towards End-to-End Code-Switching Speech Recognition
2018 · 43 citations
A comparable study of modeling units for end-to-end Mandarin speech recognition
2018 · 5 citations
DiDiSpeech: A Large Scale Mandarin Speech Corpus
2020 · 4 citations
Advancing Speech Language Models by Scaling Supervised Fine-Tuning with Over 60,000 Hours of Synthetic Speech Dialogue Data
2024 · 1 citations
Understanding the Modality Gap: An Empirical Study on the Speech-Text Alignment Mechanism of Large Speech Language Models
2025
Semantic Data Augmentation for End-to-End Mandarin Speech Recognition
2021
Top co-authors
Xiangang Li
· 6
Wei Zou
· 4
Dongwei Jiang
· 3
Tingwei Guo
· 3
Bajian Xiang
· 2
Ne Luo
· 2
Wei Zou
· 2
Caixia Gong
· 1
Chao Weng
· 1
Cheng Gong
· 1
Cheng Wen
· 1
Daniel Povey
· 1
Topics
Speech Recognition
Speech Translation
Text-to-Speech
Audio Understanding
Multimodal Audio
Voice Cloning
Audio Generation