Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Naoya Takahashi — most-cited papers & profile · Speech Audio
← authors
·
overview
Naoya Takahashi
15
papers ·
82
citations ·
16
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
D3Net: Densely connected multidilated DenseNet for music source separation
2020 · 48 citations
Hierarchical disentangled representation learning for singing voice conversion
2021 · 8 citations
MMDenseLSTM: An efficient combination of convolutional and recurrent neural networks for audio source separation
2018 · 6 citations
Recursive speech separation for unknown number of speakers
2019 · 6 citations
Hierarchical Diffusion Models for Singing Voice Neural Vocoder
2022 · 4 citations
Robust One-Shot Singing Voice Conversion
2022 · 4 citations
End-to-end lyrics Recognition with Voice to Singing Style Transfer
2021 · 3 citations
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
2023 · 3 citations
Automatic Pronunciation Generation by Utilizing a Semi-supervised Deep Neural Networks
2016
Improving Voice Separation by Incorporating End-to-end Speech Recognition
2019
Leveraging Symmetrical Convolutional Transformer Networks for Speech to Singing Voice Style Transfer
2022
DiffRoll: Diffusion-based Generative Music Transcription with Unsupervised Pretraining Capability
2022
Nonparallel Emotional Voice Conversion For Unseen Speaker-Emotion Pairs Using Dual Domain Adversarial Network & Virtual Domain Pairing
2023
Cross-modal Face- and Voice-style Transfer
2023
Iteratively Improving Speech Recognition and Voice Conversion
2023
Top co-authors
Yuki Mitsufuji
· 10
Mayank Kumar Singh
· 3
Sriram Ganapathy
· 3
Mayank Kumar Singh
· 2
Nabarun Goswami
· 2
Parthasaarathy Sudarsanam
· 2
Ryosuke Sawata
· 2
Sakya Basak
· 2
Shrutina Agarwal
· 2
Shusuke Takahashi
· 2
Beat Pfister
· 1
Dorien Herremans
· 1
Topics
Audio Generation
Music Generation
Speech Recognition
Audio Understanding
Voice Cloning
Speech Enhancement
Speech Translation
Speaker Analysis
Text-to-Speech
Multimodal Audio