Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Chao-Han Huck Yang — most-cited papers & profile · Multimodal
← authors
·
overview
Chao-Han Huck Yang
60
papers ·
153
citations ·
20
h-index
Nvidia (United Kingdom) · Nvidia (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment
2025
Omnivinci: Enhancing Architecture And Data For Omni-modal Understanding LLM
2025
Top co-authors
Arushi Goel
· 1
Boris Ginsburg
· 1
Chee-En Yu
· 1
Cheng-Han Chiang
· 1
Chi-An Fu
· 1
Chien-yu Huang
· 1
Chih-Kai Yang
· 1
Chun-Wei Chen
· 1
Chun-Yi Kuan
· 1
En-Pei Hu
· 1
Hanrong Ye
· 1
Hsiao-Ying Huang
· 1
Topics
Vision-Language Models
Benchmarks
Audio-Visual
Video-Language