Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Chengyou Wang — most-cited papers & profile · Speech Audio
← authors
·
overview
Chengyou Wang
11
papers ·
19
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
OSUM-EChat: Enhancing End-to-End Empathetic Spoken Chatbot via Understanding-Driven Spoken Dialogue
2025 · 19 citations
Seeing the Context: Rich Visual Context-Aware Speech Recognition via Multimodal Reasoning
2026
OmniCodec: Low Frame Rate Universal Audio Codec with Semantic-Acoustic Disentanglement
2026
VoiceSculptor: Your Voice, Designed By You
2026
WenetSpeech-Wu: Datasets, Benchmarks, and Models for a Unified Chinese Wu Dialect Speech Processing Ecosystem
2026
DialoSpeech: Dual-Speaker Dialogue Generation with LLM and Flow Matching
2025
WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation
2025
Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages
2025
WenetSpeech-Chuan: A Large-Scale Sichuanese Corpus with Rich Annotation for Dialectal Speech Processing
2025
Weakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR
2025
OSUM: Advancing Open Speech Understanding Models with Limited Resources in Academia
2025
Top co-authors
Lei Xie
· 9
Mingchen Shao
· 6
Wenjie Tian
· 5
Ziyu Zhang
· 5
Binbin Zhang
· 4
Bingshen Mu
· 4
Dake Guo
· 4
Hongfei Xue
· 4
Jingbin Hu
· 4
Shuiyuan Wang
· 4
Yuhang Dai
· 4
Hanke Xie
· 3
Topics
cs.SD
eess.AS
Speech Recognition
Text-to-Speech
Speech Translation
Multimodal Audio
cs.CL
Audio Understanding
Speaker Analysis