Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Hai Yu — most-cited papers & profile · Speech Audio
← authors
·
overview
Hai Yu
9
papers ·
8
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
X-OPD: Cross-Modal On-Policy Distillation for Capability Alignment in Speech LLMs
2026
DrVoice: Parallel Speech-Text Voice Conversation Model via Dual-Resolution Speech Representations
2025
OmniFlatten: An End-to-end GPT Model for Seamless Voice Conversation
2024
Loss Masking Is Not Needed in Decoder-only Transformer for Discrete-token-based ASR
2023
Top co-authors
Chong Deng
· 3
Jiaqing Liu
· 3
Qian Chen
· 3
Qinglin Zhang
· 3
Siqi Zheng
· 3
Wen Wang
· 3
Chong Zhang
· 2
Luyao Cheng
· 2
Shiliang Zhang
· 2
Yukun Ma
· 2
Chaohong Tan
· 1
Chao-Hong Tan
· 1
Topics
Multimodal Audio
Speech Recognition
Text-to-Speech
Audio Generation
Audio Understanding
Voice Cloning
Speech Enhancement