Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Rogerio Feris — most-cited papers & profile · Speech Audio
← authors
·
overview
Rogerio Feris
22
papers ·
324
citations ·
49
h-index
IBM (United States) · Moscow Institute of Thermal Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
mWhisper-Flamingo for Multilingual Audio-Visual Noise-Robust Speech Recognition
2025 · 1 citations
Towards Audio Token Compression in Large Audio Language Models
2025
Omni-R1: Do You Really Need Audio to Fine-Tune Your Audio LLM?
2025
Comparison of Multilingual Self-Supervised and Weakly-Supervised Speech Pre-Training for Adaptation to Unseen Languages
2023
Whisper-Flamingo: Integrating Visual Features into Whisper for Audio-Visual Speech Recognition and Translation
2024
State-Space Large Audio Language Models
2024
Top co-authors
Hilde Kuehne
· 6
James Glass
· 6
Leonid Karlinsky
· 3
Yuan Gong
· 2
David Harwath
· 1
Sameer Khurana
· 1
Topics
Multimodal Audio
Speech Recognition
Audio Understanding
Speech Translation
eess.AS
cs.AI
cs.CL
Text-to-Speech