Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Mike Seltzer — most-cited papers & profile · Speech Audio
← authors
·
overview
Mike Seltzer
13
papers ·
507
citations ·
11
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Achieving Human Parity in Conversational Speech Recognition
2016 · 479 citations
Emformer: Efficient Memory Transformer Based Acoustic Model For Low Latency Streaming Speech Recognition
2020 · 13 citations
On lattice-free boosted MMI training of HMM and CTC-based full-context ASR models
2021 · 11 citations
Prompting Large Language Models with Speech Recognition Abilities
2023 · 2 citations
Streaming Transformer Transducer Based Speech Recognition Using Non-Causal Convolution
2021 · 1 citations
Multi-Head State Space Model for Speech Recognition
2023 · 1 citations
Scaling Speech Tokenizers with Diffusion Autoencoders
2026
Can Speech LLMs Think while Listening?
2025
SemAlignVC: Enhancing zero-shot timbre conversion using semantic alignment
2025
TODM: Train Once Deploy Many Efficient Supernet-Based RNN-T Compression For On-device ASR Models
2023
AudioChatLlama: Towards General-Purpose Speech Abilities for LLMs
2023
Get Large Language Models Ready to Speak: A Late-fusion Approach for Speech Generation
2024
Transducer-Llama: Integrating LLMs into Streamable Transducer-based Speech Recognition
2024
Top co-authors
Ozlem Kalinli
· 7
Chunyang Wu
· 6
Jay Mahadeokar
· 6
Yuan Shangguan
· 5
Junteng Jia
· 4
Yangyang Shi
· 4
Yassir Fathullah
· 4
Christian Fuegen
· 2
Chunxi Liu
· 2
Dilin Wang
· 2
Egor Lakomkin
· 2
Frank Zhang
· 2
Topics
Speech Recognition
Speech Translation
Audio Understanding
Audio Generation
Multimodal Audio
Voice Cloning
Text-to-Speech
Music Generation