Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yuki Mitsufuji — most-cited papers & profile · Speech Audio
← authors
·
overview
Yuki Mitsufuji
48
papers ·
149
citations ·
19
h-index
Sony Corporation (United States) · Sony Computer Science Laboratories
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
D3Net: Densely connected multidilated DenseNet for music source separation
2020 · 48 citations
SQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic Quantization
2022 · 13 citations
Improving DNN-based Music Source Separation using Phase Features
2018 · 12 citations
Hierarchical disentangled representation learning for singing voice conversion
2021 · 8 citations
MMDenseLSTM: An efficient combination of convolutional and recurrent neural networks for audio source separation
2018 · 6 citations
Recursive speech separation for unknown number of speakers
2019 · 6 citations
Training Speech Enhancement Systems with Noisy Speech Datasets
2021 · 6 citations
Hierarchical Diffusion Models for Singing Voice Neural Vocoder
2022 · 4 citations
Robust One-Shot Singing Voice Conversion
2022 · 4 citations
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
2023 · 3 citations
Automatic Piano Transcription with Hierarchical Frequency-Time Transformer
2023 · 3 citations
Diffiner: A Versatile Diffusion-based Generative Refiner for Speech Enhancement
2022 · 1 citations
Music Mixing Style Transfer: A Contrastive Learning Approach to Disentangle Audio Effects
2022 · 1 citations
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
2024 · 1 citations
DeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning
2025
Top co-authors
Naoya Takahashi
· 10
Stefan Uhlich
· 7
Wei-Hsiang Liao
· 7
Shusuke Takahashi
· 6
Kin Wai Cheuk
· 5
Marco A. Mart\'inez-Ram\'irez
· 5
Naoki Murata
· 5
Giorgio Fabbro
· 4
Takashi Shibuya
· 4
Junghyun Koo
· 3
Kyogu Lee
· 3
Ryosuke Sawata
· 3
Topics
Music Generation
Audio Understanding
Audio Generation
Speech Enhancement
Multimodal Audio
Speech Translation
Speech Recognition
Voice Cloning
Text-to-Speech
Speaker Analysis