Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yidi Jiang — most-cited papers & profile · Speech Audio
← authors
·
overview
Yidi Jiang
12
papers ·
3
citations ·
9
h-index
Sunnybrook Health Science Centre · National University of Singapore · Sunnybrook Hospital
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Knowledge Distillation from BERT Transformer to Speech Transformer for Intent Classification
2021 · 16 citations
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
2025 · 2 citations
Target Speech Diarization with Multimodal Prompts
2024 · 1 citations
Detect, Attend and Extract: Keyword Guided Target Speaker Extraction
2026
Interpolating Speaker Identities in Embedding Space for Data Expansion
2025
InspireMusic: Integrating Super Resolution and Large Language Model for High-Fidelity Long-Form Music Generation
2025
Target Active Speaker Detection with Audio-visual Cues
2023
Prompt-driven Target Speech Diarization
2023
The NUS-HLT System for ICASSP2024 ICMC-ASR Grand Challenge
2023
Voice Conversion Augmentation for Speaker Recognition on Defective Datasets
2024
WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling
2024
Flow-TSVAD: Target-Speaker Voice Activity Detection via Latent Flow Matching
2024
Top co-authors
Haizhou Li
· 8
Ruijie Tao
· 5
Qian Chen
· 3
Shuai Wang
· 3
Wen Wang
· 3
Yanmin Qian
· 3
Zhengyang Chen
· 3
Chong Zhang
· 2
Jingru Lin
· 2
Shengpeng Ji
· 2
Tianchi Liu
· 2
Yu Xi
· 2
Topics
Speech Recognition
Audio Understanding
Speaker Analysis
Audio Generation
Multimodal Audio
Speech Translation
eess.AS
Music Generation
cs.AI
Speech Enhancement