Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yuchen Hu — most-cited papers & profile · Speech Audio
← authors
·
overview
Yuchen Hu
12
papers ·
19
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
HyPoradise: An Open Baseline for Generative Speech Recognition with Large Language Models
2023 · 8 citations
Large Language Models are Efficient Learners of Noise-Robust Speech Recognition
2024 · 3 citations
It's Never Too Late: Fusing Acoustic Information into Large Language Models for Automatic Speech Recognition
2024 · 3 citations
Self-Taught Recognizer: Toward Unsupervised Adaptation for Speech Foundation Models
2024 · 3 citations
Generative error correction for code-switching speech recognition using large language models
2023 · 1 citations
Robust Zero-Shot Text-to-Speech Synthesis with Reverse Inference Optimization
2024 · 1 citations
GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling
2025
SSR-Speech: Towards Stable, Safe and Robust Zero-shot Text-based Speech Editing and Synthesis
2024
GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators
2024
Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models
2024
Enhancing Zero-shot Text-to-Speech Synthesis with Human Feedback
2024
Large Language Model Based Generative Error Correction: A Challenge and Baselines for Speech Recognition, Speaker Tagging, and Emotion Recognition
2024
Top co-authors
Eng Siong Chng
· 8
Chao-Han Huck Yang
· 7
Chen Chen
· 7
Pin-Yu Chen
· 4
Ruizhe Li
· 4
Chen Chen
· 3
Sabato Marco Siniscalchi
· 3
Chao Zhang
· 2
Chengwei Qin
· 2
EnSiong Chng
· 2
Helin Wang
· 2
Hexin Liu
· 2
Topics
Speech Recognition
Speech Translation
Text-to-Speech
Speech Enhancement
Audio Understanding
Audio Generation
Multimodal Audio
Speaker Analysis