Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Dan Su — most-cited papers & profile · Speech Audio
← authors
·
overview
Dan Su
63
papers ·
629
citations ·
10
h-index
Central South University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio
2021 · 201 citations
DurIAN: Duration Informed Attention Network For Multimodal Synthesis
2019 · 94 citations
End-to-End Multi-Channel Speech Separation
2019 · 81 citations
FastDiff: A Fast Conditional Diffusion Model for High-Quality Speech Synthesis
2022 · 28 citations
BDDM: Bilateral Denoising Diffusion Models for Fast and High-Quality Speech Synthesis
2022 · 26 citations
DiffGAN-TTS: High-Fidelity and Efficient Text-to-Speech with Denoising Diffusion GANs
2022 · 19 citations
Replay and Synthetic Speech Detection with Res2net Architecture
2020 · 18 citations
VARA-TTS: Non-Autoregressive Text-to-Speech Synthesis based on Very Deep VAE with Residual Attention
2021 · 15 citations
Deep Extractor Network for Target Speaker Recovery From Single Channel Speech Mixtures
2018 · 14 citations
Maximizing Mutual Information for Tacotron
2019 · 13 citations
Speech-XLNet: Unsupervised Acoustic Model Pretraining For Self-Attention Networks
2019 · 11 citations
Phonetic Posteriorgrams based Many-to-Many Singing Voice Conversion via Adversarial Training
2020 · 10 citations
Effective Low-Cost Time-Domain Audio Separation Using Globally Attentive Locally Recurrent Networks
2021 · 9 citations
Meta-Voice: Fast few-shot style transfer for expressive voice cloning using meta learning
2021 · 8 citations
DFSMN-SAN with Persistent Memory Model for Automatic Speech Recognition
2019 · 5 citations
Top co-authors
Dong Yu
· 34
Helen Meng
· 14
Jun Wang
· 9
Shan Yang
· 9
Lei Xie
· 8
Meng Yu
· 7
Songxiang Liu
· 7
Zhiyong Wu
· 7
Bo Wu
· 4
Peng Liu
· 4
Shi-Xiong Zhang
· 4
Shiyin Kang
· 4
Topics
Speech Recognition
Audio Generation
Text-to-Speech
Speech Translation
Speech Enhancement
Voice Cloning
Audio Understanding
Speaker Analysis
Multimodal Audio
Music Generation