Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Rithesh Kumar — most-cited papers & profile · Speech Audio
← authors
·
overview
Rithesh Kumar
10
papers ·
440
citations ·
8
h-index
Adobe Systems (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
SampleRNN: An Unconditional End-to-End Neural Audio Generation Model
2016 · 363 citations
High-Fidelity Audio Compression with Improved RVQGAN
2023 · 66 citations
NU-GAN: High resolution neural upsampling with GAN
2020 · 22 citations
DiTSE: High-Fidelity Generative Speech Enhancement via Latent Diffusion Transformers
2025 · 15 citations
SpeakEasy: Enhancing Text-to-Speech Interactions for Expressive Content Creation
2025 · 7 citations
VampNet: Music Generation via Masked Acoustic Token Modeling
2023 · 7 citations
PromptSep: Generative Audio Separation via Multimodal Prompting
2025 · 2 citations
Taming Audio VAEs via Target-KL Regularization
2026
SpeechOp: Inference-Time Task Composition for Generative Speech Processing
2025
DMOSpeech: Direct Metric Optimization via Distilled Diffusion Model in Zero-Shot Speech Synthesis
2024
Top co-authors
Zeyu Jin
· 5
Prem Seetharaman
· 4
Jiaqi Su
· 3
Kundan Kumar
· 3
Aaron Courville
· 2
Ke Chen
· 2
Yoshua Bengio
· 2
Alejandro Luebs
· 1
Anh Truong
· 1
Bryan Pardo
· 1
Heitor R. Guimar\~aes
· 1
Hugo Flores Garcia
· 1
Topics
Audio Generation
Text-to-Speech
Music Generation
cs.LG
eess.AS
Speech Enhancement
Speech Translation
Multimodal Audio
cs.SD
Voice Cloning