Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Ke Li — most-cited papers & profile · Speech Audio
← authors
·
overview
Ke Li
87
papers ·
397
citations ·
0
h-index
University of Exeter
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Private Language Model Adaptation for Speech Recognition
2021 · 4 citations
VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
2025 · 3 citations
Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM
2024 · 3 citations
A Domain Adaptation Framework for Speech Recognition Systems with Only Synthetic data
2025 · 2 citations
speechocean762: An Open-Source Non-native English Speech Corpus For Pronunciation Assessment
2021 · 2 citations
Prompting Large Language Models with Speech Recognition Abilities
2023 · 2 citations
GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement
2024 · 2 citations
DeepOmni: Towards Seamless and Smart Speech Interaction with Adaptive Modality-Specific MoE
2025 · 1 citations
Streaming Transformer Transducer Based Speech Recognition Using Non-Causal Convolution
2021 · 1 citations
Enhancing Multilingual LLM-based ASR with Mixture of Experts and Dynamic Downsampling
2026
X-Voice: Enabling Everyone to Speak 30 Languages via Zero-Shot Cross-Lingual Voice Cloning
2026
The Interspeech 2026 Audio Encoder Capability Challenge for Large Audio Language Models
2026
VITA-Audio: Fast Interleaved Cross-Modal Token Generation for Efficient Large Speech-Language Model
2025
Dolphin: A Large-Scale Automatic Speech Recognition Model for Eastern Languages
2025
The ICME 2025 Audio Encoder Capability Challenge
2025
Top co-authors
Ozlem Kalinli
· 8
Jay Mahadeokar
· 7
Chunyang Wu
· 5
Jinxi Guo
· 4
Junteng Jia
· 4
Xing Sun
· 4
Yuan Shangguan
· 4
Yunhang Shen
· 4
Chaoyou Fu
· 3
Christian Fuegen
· 3
Duc Le
· 3
Egor Lakomkin
· 3
Topics
Speech Recognition
Speech Translation
Multimodal Audio
Audio Understanding
Text-to-Speech
Audio Generation
Speaker Analysis
Speech Enhancement
cs.CL
cs.AI