Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Baosong Yang — most-cited papers & profile · Speech Audio
← authors
·
overview
Baosong Yang
17
papers ·
333
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MinMo: A Multimodal Large Language Model for Seamless Voice Interaction
2025 · 86 citations
Qwen3-ASR Technical Report
2026
Qwen3-TTS Technical Report
2026
Direct Simultaneous Translation Activation for Large Audio-Language Models
2025
PART: Progressive Alignment Representation Training for Multilingual Speech-To-Text with LLMs
2025
Top co-authors
Pei Zhang
· 5
Hongkun Hao
· 2
Jialong Tang
· 2
Jingren Zhou
· 2
Jin Xu
· 2
Junyang Lin
· 2
Xian Shi
· 2
Xinyu Zhang
· 2
Xiong Wang
· 2
Zhifang Guo
· 2
Zishan Guo
· 2
Andong Chen
· 1
Topics
cs.CL
cs.SD
eess.AS
Multimodal Audio
Text-to-Speech
Speech Recognition
Audio Generation
Voice Cloning