Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Haohe Liu — most-cited papers & profile · Speech Audio
← authors
·
overview
Haohe Liu
29
papers ·
223
citations ·
18
h-index
University of Surrey
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
AudioLDM: Text-to-Audio Generation with Latent Diffusion Models
2023 · 82 citations
Decoupling Magnitude and Phase Estimation with Deep ResUNet for Music Source Separation
2021 · 38 citations
NaturalSpeech: End-to-End Text to Speech Synthesis with Human-Level Quality
2022 · 35 citations
VoiceFixer: Toward General Speech Restoration with Neural Vocoder
2021 · 25 citations
UniFlow-Audio: Unified Flow Matching for Audio Generation from Omni-Modalities
2025 · 7 citations
Neural Vocoder is All You Need for Speech Super-resolution
2022 · 7 citations
VoiceFixer: A Unified Framework for High-Fidelity Speech Restoration
2022 · 6 citations
ResGrad: Residual Denoising Diffusion Probabilistic Models for Text to Speech
2022 · 5 citations
AudioLDM 2: Learning Holistic Audio Generation with Self-supervised Pretraining
2023 · 5 citations
Simple Pooling Front-ends For Efficient Audio Classification
2022 · 3 citations
MusicLDM: Enhancing Novelty in Text-to-Music Generation Using Beat-Synchronous Mixup Strategies
2023 · 3 citations
Channel-wise Subband Input for Better Voice and Accompaniment Separation on High Resolution Music
2020 · 2 citations
Speech enhancement with weakly labelled data from AudioSet
2021 · 2 citations
EnvSDD: Benchmarking Environmental Sound Deepfake Detection
2025 · 1 citations
AudioSR: Versatile Audio Super-resolution at Scale
2023 · 1 citations
Top co-authors
Wenwu Wang
· 10
Qiuqiang Kong
· 9
Mark D. Plumbley
· 8
Xubo Liu
· 8
Yuxuan Wang
· 6
Yi Yuan
· 5
Xu Tan
· 4
Lei Xie
· 3
Mengyue Wu
· 3
Xinhao Mei
· 3
Yike Guo
· 3
Zhen Ye
· 3
Topics
Audio Generation
Audio Understanding
Music Generation
Multimodal Audio
Text-to-Speech
Speech Enhancement
cs.SD
eess.AS
Speech Translation
Speech Recognition