Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yile Gu — most-cited papers & profile · Speech Audio
← authors
·
overview
Yile Gu
12
papers ·
72
citations ·
14
h-index
Amazon (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Generative Speech Recognition Error Correction with Large Language Models and Task-Activating Prompting
2023 · 46 citations
Domain-aware Neural Language Models for Speech Recognition
2021 · 15 citations
Improving accuracy of rare words for RNN-Transducer through unigram shallow fusion
2020 · 7 citations
Low-rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition
2023 · 3 citations
Discriminative Speech Recognition Rescoring with Pre-trained Language Models
2023 · 1 citations
Group Relative Policy Optimization for Speech Recognition
2025
Multi-task Language Modeling for Improving Speech Recognition of Rare Words
2020
Distillation Strategies for Discriminative Speech Recognition Rescoring
2023
Personalization for BERT-based Discriminative Speech Recognition Rescoring
2023
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
2024
Multi-Modal Retrieval For Large Language Model Based Speech Recognition
2024
Align-SLM: Textless Spoken Language Models with Reinforcement Learning from AI Feedback
2024
Top co-authors
Ivan Bulyko
· 12
Ankur Gandhe
· 11
Ariya Rastrow
· 7
Prashanth Gurunath Shivakumar
· 7
Jari Kolehmainen
· 6
Aditya Gourav
· 5
Denis Filimonov
· 4
Andreas Stolcke
· 3
Chao-Han Huck Yang
· 3
Linda Liu
· 3
Shalini Ghosh
· 3
Guan-Ting Lin
· 2
Topics
Speech Recognition
Speech Translation
Audio Understanding
Multimodal Audio
Text-to-Speech
Audio Generation