Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Romain Serizel (MULTISPEECH — most-cited papers & profile · Speech Audio
← authors
·
overview
Romain Serizel (MULTISPEECH
14
papers ·
2
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Posterior Transition Modeling for Unsupervised Diffusion-Based Speech Enhancement
2025 · 2 citations
Towards Low-Latency Tracking of Multiple Speakers With Short-Context Speaker Embeddings
2025
Attention-based distributed speech enhancement for unconstrained microphone arrays with varying number of nodes
2021
How to Leverage DNN-based speech enhancement for multi-channel speaker verification?
2022
Audio-visual speech enhancement with a deep Kalman filter generative model
2022
A weighted-variance variational autoencoder model for speech enhancement
2022
Fast and efficient speech enhancement with variational autoencoders
2022
Self-supervised learning with diffusion-based multichannel speech enhancement for speaker verification under noisy conditions
2023
SAMbA: Speech enhancement with Asynchronous ad-hoc Microphone Arrays
2023
Posterior sampling algorithms for unsupervised speech enhancement with recurrent variational autoencoder
2023
Unsupervised speech enhancement with diffusion-based generative models
2023
Diffusion-based speech enhancement with a weighted generative-supervised learning loss
2023
Diffusion-based Unsupervised Audio-visual Speech Enhancement
2024
Top co-authors
Mostafa Sadeghi (MULTISPEECH
· 8
Jean-Eudes Ayilo (MULTISPEECH
· 3
Xavier Alameda-Pineda (ROBOTLEARN
· 3
Ali Golmakani (MULTISPEECH
· 2
Ajinkya Kulkarni
· 1
Alexandre Gu\'erin
· 1
Bern\'e Nortier (MULTISPEECH
· 1
Denis Jouvet
· 1
Denis Jouvet (MULTISPEECH
· 1
Driss Matrouf (LIA
· 1
Irina Illina (LORIA
· 1
Irina Illina (MULTISPEECH
· 1
Topics
Speech Enhancement
Speaker Analysis
Audio Understanding
Multimodal Audio
Speech Translation
Text-to-Speech
Speech Recognition