Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xuanjun Chen — most-cited papers & profile · Multimodal
← authors
·
overview
Xuanjun Chen
18
papers ·
52
citations ·
6
h-index
National Taiwan University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment
2025
Top co-authors
Boris Ginsburg
· 1
Chao-Han Huck Yang
· 1
Chee-En Yu
· 1
Cheng-Han Chiang
· 1
Chi-An Fu
· 1
Chien-yu Huang
· 1
Chih-Kai Yang
· 1
Chun-Wei Chen
· 1
Chun-Yi Kuan
· 1
En-Pei Hu
· 1
Hsiao-Ying Huang
· 1
Huang-Cheng Chou
· 1
Topics
Vision-Language Models
Video-Language
Benchmarks
Audio-Visual