Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Junbo Zhang — most-cited papers & profile · Speech Audio
← authors
·
overview
Junbo Zhang
39
papers ·
793
citations ·
55
h-index
Beijing Jiaotong University · Jingdong (China) · Southwest Jiaotong University · Xiaomi (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio
2021 · 201 citations
Data Augmentation For Children's Speech Recognition -- The "Ethiopian" System For The SLT 2021 Children Speech Recognition Challenge
2020 · 11 citations
Attention-Based End-to-End Speech Recognition on Voice Search
2017 · 2 citations
speechocean762: An Open-Source Non-native English Speech Corpus For Pronunciation Assessment
2021 · 2 citations
Focus on the Sound around You: Monaural Target Speaker Extraction via Distance and Speaker Information
2023 · 1 citations
Dasheng AudioGen: A Unified Model for Generating Coherent Audio Scenes from Text
2026
The Interspeech 2026 Audio Encoder Capability Challenge for Large Audio Language Models
2026
ACAVCaps: Enabling large-scale training for fine-grained and diverse audio understanding
2026
DashengTokenizer: One layer is enough for unified audio understanding and generation
2026
Efficient Speech Enhancement via Embeddings from Pre-trained Generative Audioencoders
2025
X-ARES: A Comprehensive Framework for Assessing Audio Encoder Performance
2025
The ICME 2025 Audio Encoder Capability Challenge
2025
Investigating Generative Adversarial Networks based Speech Dereverberation for Robust Speech Recognition
2018
An empirical study of weakly supervised audio tagging embeddings for general audio representations
2022
Streaming Audio Transformers for Online Audio Tagging
2023
Top co-authors
Jian Luan
· 7
Gang Li
· 3
Ke Li
· 3
Lei Xie
· 2
Wenwu Wang
· 2
Yifan Liao
· 2
Zhiyong Wu
· 2
Bin Wang
· 1
Chenyu Liu
· 1
Dan Su
· 1
Jun Chen
· 1
Ke Wang
· 1
Topics
Speech Recognition
Audio Understanding
Audio Generation
Speech Translation
Multimodal Audio
Speech Enhancement
Speaker Analysis
cs.SD
eess.AS
Text-to-Speech