Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yushen Chen — most-cited papers & profile · Speech Audio
← authors
·
overview
Yushen Chen
7
papers ·
1
citations ·
5
h-index
Shanghai Jiao Tong University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching
2024 · 1 citations
WavTTS: Towards High-Quality Zero-Shot TTS via Direct Raw Waveform Modeling
2026
X-Voice: Enabling Everyone to Speak 30 Languages via Zero-Shot Cross-Lingual Voice Cloning
2026
WavCube: Unifying Speech Representation for Understanding and Generation via Semantic-Acoustic Joint Modeling
2026
UniSonate: A Unified Model for Speech, Music, and Sound Effect Generation with Text Instructions
2026
Accelerating Flow-Matching-Based Text-to-Speech via Empirically Pruned Step Sampling
2025
Towards Flow-Matching-based TTS without Classifier-Free Guidance
2025
Top co-authors
Xie Chen
· 3
Zhikang Niu
· 3
Ziyang Ma
· 3
and Xie Chen
· 2
Guanrou Yang
· 2
Kai Yu
· 2
Zhikang Niu
· 2
and Jianwu Dang
· 1
Berrak Sisman
· 1
Cheng Gong
· 1
Chen Zhang
· 1
Chen Zhang
· 1
Topics
Audio Generation
Text-to-Speech
Music Generation
Voice Cloning
Speech Enhancement
Audio Understanding
Multimodal Audio