Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Helin Wang — most-cited papers & profile · Speech Audio
← authors
·
overview
Helin Wang
16
papers ·
15
citations ·
12
h-index
Johns Hopkins University · Johns Hopkins Medicine
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Improving the Performance of Automated Audio Captioning via Integrating the Acoustic and Semantic Information
2021 · 11 citations
Masked Spectrogram Prediction For Self-Supervised Audio Pre-Training
2022 · 1 citations
NoreSpeech: Knowledge Distillation based Conditional Diffusion Model for Noise-robust Expressive TTS
2022 · 1 citations
Improving fairness for spoken language understanding in atypical speech with Text-to-Speech
2023 · 1 citations
EzAudio: Enhancing Text-to-Audio Generation with Efficient Diffusion Transformer
2024 · 1 citations
Spoken DialogSum: An Emotion-Rich Conversational Dataset for Spoken Dialogue Summarization
2025
SAM Audio: Segment Anything in Audio
2025
ReFESS-QI: Reference-Free Evaluation For Speech Separation With Joint Quality And Intelligibility Scoring
2025
ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling
2025
SSR-Speech: Towards Stable, Safe and Robust Zero-shot Text-based Speech Editing and Synthesis
2024
SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer
2024
Layer Reduction: Accelerating Conformer-Based Self-Supervised Model via Layer Consistency
2021
Enhancing Zero-shot Text-to-Speech Synthesis with Human Feedback
2024
Noise-robust Speech Separation with Fast Generative Correction
2024
DreamVoice: Text-Guided Voice Conversion
2024
Top co-authors
Jiarui Hai
· 5
Najim Dehak
· 5
Laureano Moro-Velazquez
· 3
Mounya Elhilali
· 3
Thomas Thebaud
· 3
Yuexian Zou
· 3
Dongchao Yang
· 2
Jesus Villalba
· 2
Karan Thakkar
· 2
Yen-Ju Lu
· 2
Yuchen Hu
· 2
Adi Arbel
· 1
Topics
Audio Understanding
Audio Generation
Text-to-Speech
Speech Recognition
Multimodal Audio
Speech Enhancement
Speech Translation
Speaker Analysis
Voice Cloning
Music Generation