Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Rogério Feris — most-cited papers & profile · Speech Audio
← authors
·
overview
Rogério Feris
16
papers ·
298
citations ·
49
h-index
IBM (United States) · Moscow Institute of Thermal Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
mWhisper-Flamingo for Multilingual Audio-Visual Noise-Robust Speech Recognition
2025 · 1 citations
Towards Audio Token Compression in Large Audio Language Models
2025
Omni-R1: Do You Really Need Audio to Fine-Tune Your Audio LLM?
2025
Comparison of Multilingual Self-Supervised and Weakly-Supervised Speech Pre-Training for Adaptation to Unseen Languages
2023
State-Space Large Audio Language Models
2024
Top co-authors
Hilde Kuehne
· 5
James Glass
· 4
Samuel Thomas
· 4
Andrew Rouditchenko
· 3
Saurabhchand Bhati
· 3
Leonid Karlinsky
· 2
Brian Kingsbury
· 1
David Harwath
· 1
Edson Araujo
· 1
James Glass
· 1
Sameer Khurana
· 1
Yuan Gong
· 1
Topics
Audio Understanding
Speech Recognition
Multimodal Audio
Speech Translation