Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yidi Jiang — most-cited papers & profile · Speech Audio
← authors
·
overview
Yidi Jiang
8
papers ·
3
citations ·
9
h-index
Sunnybrook Health Science Centre · National University of Singapore · Sunnybrook Hospital
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
2025 · 2 citations
Target Speech Diarization with Multimodal Prompts
2024 · 1 citations
InspireMusic: Integrating Super Resolution and Large Language Model for High-Fidelity Long-Form Music Generation
2025
Target Active Speaker Detection with Audio-visual Cues
2023
Prompt-driven Target Speech Diarization
2023
The NUS-HLT System for ICASSP2024 ICMC-ASR Grand Challenge
2023
Voice Conversion Augmentation for Speaker Recognition on Defective Datasets
2024
Flow-TSVAD: Target-Speaker Voice Activity Detection via Latent Flow Matching
2024
Top co-authors
Haizhou Li
· 6
Ruijie Tao
· 4
Yanmin Qian
· 3
Zhengyang Chen
· 3
Bing Han
· 1
Bin Ma
· 1
Chaohong Tan
· 1
Chongjia Ni
· 1
Chong Zhang
· 1
Chong Zhang
· 1
Hao Wang
· 1
Jingru Lin
· 1
Topics
Speech Recognition
Speaker Analysis
Audio Understanding
Audio Generation
Multimodal Audio
Speech Translation
Music Generation
Speech Enhancement
Voice Cloning