Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yiming Wang — most-cited papers & profile · Speech Audio
← authors
·
overview
Yiming Wang
53
papers ·
89
citations ·
14
h-index
Nanjing University of Posts and Telecommunications
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Espresso: A Fast End-to-end Neural Speech Recognition Toolkit
2019 · 14 citations
Wav2vec-Switch: Contrastive Learning from Original-noisy Speech Pairs for Robust Speech Recognition
2021 · 7 citations
End-to-end Anchored Speech Recognition
2019 · 3 citations
PyChain: A Fully Parallelized PyTorch Implementation of LF-MMI for End-to-End ASR
2020 · 1 citations
Improving Noise Robustness of Contrastive Speech Representation Learning with Speech Reconstruction
2021 · 1 citations
Rethinking Speech-LLM Integration for ASR: Effective Joint Speech-Text Training by Interleaving
2026
Data-Efficient On-Policy Distillation for Automatic Speech Recognition
2026
CoSTA: Cognitive-State-Conditioned TTS Data Augmentation Using ASR Transcripts for Alzheimer's Disease Detection
2026
LLM can Read Spectrogram: Encoder-free Speech-Language Modeling
2026
Speech LLMs are Contextual Reasoning Transcribers
2026
Unifying Speech Recognition, Synthesis and Conversion with Autoregressive Transformers
2026
Direct Simultaneous Translation Activation for Large Audio-Language Models
2025
Supervision-Guided Codebooks for Masked Prediction in Speech Pre-training
2022
Self-supervised learning with bi-label masked speech prediction for streaming multi-talker speech recognition
2022
ResidualTransformer: Residual Low-Rank Learning with Weight-Sharing for Transformer Layers
2023
Top co-authors
Jinyu Li
· 8
Chengyi Wang
· 3
Shujie Liu
· 3
Xiaofei Wang
· 3
Sanjeev Khudanpur
· 2
Takuya Yoshioka
· 2
Xiaodong Zeng
· 2
Yiwen Shao
· 2
Yu Lin
· 2
Yu Wu
· 2
Yuxuan Hu
· 2
Baosong Yang
· 1
Topics
Speech Recognition
Speech Translation
eess.AS
cs.SD
Speech Enhancement
Text-to-Speech
cs.CL
Multimodal Audio
cs.AI
Audio Understanding