Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jun Du — most-cited papers & profile · Speech Audio
← authors
·
overview
Jun Du
42
papers ·
240
citations ·
0
h-index
University of Science and Technology of China · Soochow University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Attention Based Fully Convolutional Network for Speech Emotion Recognition
2018 · 112 citations
Multi-Objective Learning and Mask-Based Post-Processing for Deep Neural Network Based Speech Enhancement
2017 · 32 citations
Multi-Task Learning with High-Order Statistics for X-vector based Text-Independent Speaker Verification
2019 · 21 citations
USTC-NELSLIP System Description for DIHARD-III Challenge
2021 · 20 citations
An Adaptive X-vector Model for Text-independent Speaker Verification
2020 · 9 citations
AISHELL-4: An Open Source Dataset for Speech Enhancement, Separation, Recognition and Speaker Diarization in Conference Scenario
2021 · 8 citations
Attentive batch normalization for lstm-based acoustic modeling of speech recognition
2020 · 5 citations
Separation Guided Speaker Diarization in Realistic Mismatched Conditions
2021 · 5 citations
Frequency Gating: Improved Convolutional Neural Networks for Speech Enhancement in the Time-Frequency Domain
2020 · 3 citations
Target-speaker Voice Activity Detection with Improved I-Vector Estimation for Unknown Number of Speaker
2021 · 2 citations
Spatially Aware Self-Supervised Models for Multi-Channel Neural Speaker Diarization
2025 · 1 citations
Integration of speech separation, diarization, and recognition for multi-speaker meetings: System description, comparison, and analysis
2020 · 1 citations
Semi-supervised multi-channel speaker diarization with cross-channel attention
2023 · 1 citations
The Multimodal Information Based Speech Processing (MISP) 2023 Challenge: Audio-Visual Target Speaker Extraction
2023 · 1 citations
DCF-DS: Deep Cascade Fusion of Diarization and Separation for Speech Recognition under Realistic Single-Channel Conditions
2024 · 1 citations
Top co-authors
Ruoyu Wang
· 9
Jia Pan
· 8
Hang Chen
· 5
Jianqing Gao
· 5
Lirong Dai
· 5
Tian Gao
· 5
Wu Guo
· 5
Zhuo Chen
· 4
Zilu Guo
· 4
Lei Sun
· 3
Shinji Watanabe
· 3
Jingdong Chen
· 2
Topics
Speaker Analysis
Speech Recognition
Audio Understanding
Speech Enhancement
Speech Translation
Multimodal Audio
Music Generation
Audio Generation