Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Zhehuai Chen — most-cited papers & profile · Speech Audio
← authors
·
overview
Zhehuai Chen
11
papers ·
104
citations ·
17
h-index
Nvidia (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment
2025 · 46 citations
Progressive Joint Modeling in Unsupervised Single-channel Overlapped Speech Recognition
2017 · 35 citations
Discrete Diffusion for Generative Modeling of Text-Aligned Speech Tokens
2025 · 6 citations
Voice Memory for Agentic Speech Recognition
2026
Top co-authors
Boris Ginsburg
· 2
Chao-Han Huck Yang
· 2
Ante Juki\'c
· 1
Chee-En Yu
· 1
Cheng-Han Chiang
· 1
Chi-An Fu
· 1
Chien-yu Huang
· 1
Chih-Kai Yang
· 1
Chun-Wei Chen
· 1
Chun-Yi Kuan
· 1
En-Pei Hu
· 1
He Huang
· 1
Topics
Speech Recognition
Speech Translation
Text-to-Speech
Audio Understanding
Multimodal Audio
Audio Generation