Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Ivan Bulyko — most-cited papers & profile · Speech Audio
← authors
·
overview
Ivan Bulyko
19
papers ·
14
citations ·
16
h-index
Amazon (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Generative Speech Recognition Error Correction with Large Language Models and Task-Activating Prompting
2023 · 46 citations
Domain-aware Neural Language Models for Speech Recognition
2021 · 15 citations
Improving accuracy of rare words for RNN-Transducer through unigram shallow fusion
2020 · 7 citations
A Likelihood Ratio based Domain Adaptation Method for E2E Models
2022 · 7 citations
Low-rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition
2023 · 3 citations
Discriminative Speech Recognition Rescoring with Pre-trained Language Models
2023 · 1 citations
Group Relative Policy Optimization for Speech Recognition
2025
Multi-task Language Modeling for Improving Speech Recognition of Rare Words
2020
Personalization Strategies for End-to-End Speech Recognition Systems
2021
Attention-based Contextual Language Model Adaptation for Speech Recognition
2021
RescoreBERT: Discriminative Speech Recognition Rescoring with BERT
2022
On-the-fly Text Retrieval for End-to-End ASR Adaptation
2023
Distillation Strategies for Discriminative Speech Recognition Rescoring
2023
Personalization for BERT-based Discriminative Speech Recognition Rescoring
2023
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
2024
Top co-authors
Ankur Gandhe
· 18
Yile Gu
· 14
Ariya Rastrow
· 11
Jari Kolehmainen
· 9
Aditya Gourav
· 8
Prashanth Gurunath Shivakumar
· 8
Andreas Stolcke
· 7
Denis Filimonov
· 6
Chao-Han Huck Yang
· 4
Linda Liu
· 4
Shalini Ghosh
· 3
Ariya Rastow
· 2
Topics
Speech Recognition
Speech Translation
Text-to-Speech
Multimodal Audio
Audio Understanding
eess.AS
Audio Generation