Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiaoda Yang — most-cited papers & profile · Speech Audio
← authors
·
overview
Xiaoda Yang
8
papers ·
31
citations ·
3
h-index
Zhejiang University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Rhythm Controllable and Efficient Zero-Shot Voice Conversion via Shortcut Flow Matching
2025
Speech Token Prediction via Compressed-to-fine Language Modeling for Speech Generation
2025
MegaTTS 3: Sparse Alignment Enhanced Latent Diffusion Transformer for Zero-Shot Speech Synthesis
2025
WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling
2024
Top co-authors
Jialong Zuo
· 4
Shengpeng Ji
· 3
Zhou Zhao
· 3
Qian Chen
· 2
Wen Wang
· 2
Xize Cheng
· 2
Boyang Zhang
· 1
Chen Zhang
· 1
Guanrou Yang
· 1
Jin Xu
· 1
Mingze Li
· 1
Qian Yang
· 1
Topics
Audio Generation
Text-to-Speech
Music Generation
Voice Cloning
Speech Enhancement
Speech Translation
Speech Recognition
Audio Understanding