Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xixin Wu — most-cited papers & profile · Speech Audio
← authors
·
overview
Xixin Wu
46
papers ·
75
citations ·
20
h-index
Chinese University of Hong Kong
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
A Sidecar Separator Can Convert a Single-Talker Speech Recognition System to a Multi-Talker One
2023 · 16 citations
UniAudio: An Audio Foundation Model Toward Universal Audio Generation
2023 · 14 citations
Maximizing Mutual Information for Tacotron
2019 · 13 citations
A Multi-Scale Time-Frequency Spectrogram Discriminator for GAN-based Non-Autoregressive TTS
2022 · 8 citations
Improved End-to-End Dysarthric Speech Recognition via Meta-learning Based Model Re-initialization
2020 · 6 citations
Cross-Speaker Encoding Network for Multi-Talker Speech Recognition
2024 · 4 citations
DrawSpeech: Expressive Speech Synthesis Using Prosodic Sketches as Control Conditions
2025 · 2 citations
Attention Forcing for Machine Translation
2021 · 2 citations
Towards High-Quality Neural TTS for Low-Resource Languages by Learning Compact Speech Representations
2022 · 2 citations
UniAudio 1.5: Large Language Model-driven Audio Codec is A Few-shot Audio Task Learner
2024 · 2 citations
Deep segmental phonetic posterior-grams based discovery of non-categories in L2 English speech
2020 · 1 citations
Unified Modeling of Multi-Talker Overlapped Speech Recognition and Diarization with a Sidecar Separator
2023 · 1 citations
MSStyleTTS: Multi-Scale Style Modeling with Hierarchical Context Information for Expressive Speech Synthesis
2023 · 1 citations
CoLM-DSR: Leveraging Neural Codec Language Modeling for Multi-Modal Dysarthric Speech Reconstruction
2024 · 1 citations
PerTTS: Personalized and Controllable Zero-Shot Spontaneous Style Text-to-Speech Synthesis
2026
Top co-authors
Helen Meng
· 38
Xunying Liu
· 11
Dongchao Yang
· 10
Haohan Guo
· 10
Zhiyong Wu
· 9
Jiawen Kang
· 8
Fenglong Xie
· 6
Disong Wang
· 5
Lingwei Meng
· 5
Xueyuan Chen
· 5
Lingwei Meng
· 4
Shiyin Kang
· 4
Topics
Audio Generation
Text-to-Speech
Speech Recognition
Audio Understanding
Speech Enhancement
Speech Translation
Voice Cloning
Multimodal Audio
Speaker Analysis
Music Generation