Awesome Computer Vision
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yuki Mitsufuji — most-cited papers & profile · Computer Vision
← authors
·
overview
Yuki Mitsufuji
48
papers ·
149
citations ·
19
h-index
Sony Corporation (United States) · Sony Computer Science Laboratories
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
D3Net: Densely connected multidilated DenseNet for music source separation
2020 · 48 citations
SQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic Quantization
2022 · 13 citations
SQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic Quantization
2022 · 13 citations
Improving DNN-based Music Source Separation using Phase Features
2018 · 12 citations
A Survey on Diffusion Models for Inverse Problems
2024 · 9 citations
Hierarchical disentangled representation learning for singing voice conversion
2021 · 8 citations
MMDenseLSTM: An efficient combination of convolutional and recurrent neural networks for audio source separation
2018 · 6 citations
Recursive speech separation for unknown number of speakers
2019 · 6 citations
Training Speech Enhancement Systems with Noisy Speech Datasets
2021 · 6 citations
SAN: Inducing Metrizability of GAN with Discriminative Normalized Linear Layer
2023 · 5 citations
Hierarchical Diffusion Models for Singing Voice Neural Vocoder
2022 · 4 citations
Robust One-Shot Singing Voice Conversion
2022 · 4 citations
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
2023 · 3 citations
Automatic Piano Transcription with Hierarchical Frequency-Time Transformer
2023 · 3 citations
Denoising Multi-Beta VAE: Representation Learning for Disentanglement and Generation
2025 · 2 citations
Top co-authors
J. Zico Kolter
· 1
Michail Dontas
· 1
Naoki Murata
· 1
Ruslan Salakhutdinov
· 1
Yutong He
· 1
Topics
Audio Generation
Music Generation
Diffusion Models
Audio Understanding
Training & Sampling
Speech Enhancement
Conditioning & Control
3D & NeRF Generation
Multimodal Audio
Text-to-Image