Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Haohe Liu — most-cited papers & profile · Speech Audio
← authors
·
overview
Haohe Liu
19
papers ·
175
citations ·
18
h-index
University of Surrey
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
AudioLDM: Text-to-Audio Generation with Latent Diffusion Models
2023 · 82 citations
Decoupling Magnitude and Phase Estimation with Deep ResUNet for Music Source Separation
2021 · 38 citations
NaturalSpeech: End-to-End Text to Speech Synthesis with Human-Level Quality
2022 · 35 citations
ResGrad: Residual Denoising Diffusion Probabilistic Models for Text to Speech
2022 · 5 citations
AudioLDM 2: Learning Holistic Audio Generation with Self-supervised Pretraining
2023 · 5 citations
Simple Pooling Front-ends For Efficient Audio Classification
2022 · 3 citations
MusicLDM: Enhancing Novelty in Text-to-Music Generation Using Beat-Synchronous Mixup Strategies
2023 · 3 citations
EnvSDD: Benchmarking Environmental Sound Deepfake Detection
2025 · 1 citations
AudioSR: Versatile Audio Super-resolution at Scale
2023 · 1 citations
FlashSpeech: Efficient Zero-Shot Speech Synthesis
2024 · 1 citations
DreamAudio: Customized Text-to-Audio Generation with Diffusion Models
2025
Inference-time Scaling for Diffusion-based Audio Super-resolution
2025
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion
2025
Llasa: Scaling Train-Time and Inference-Time Compute for Llama-based Speech Synthesis
2025
Retrieval-Augmented Text-to-Audio Generation
2023
Top co-authors
Wenwu Wang
· 10
Mark D. Plumbley
· 8
Qiuqiang Kong
· 5
Xubo Liu
· 4
Xinhao Mei
· 3
Xu Tan
· 3
Yike Guo
· 3
Zhen Ye
· 3
Danilo Mandic
· 2
Jianyi Chen
· 2
Jiawei Chen
· 2
Ke Chen
· 2
Topics
Audio Generation
Music Generation
Multimodal Audio
Text-to-Speech
Audio Understanding
Speech Enhancement
Speech Recognition
Voice Cloning