Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yujun Cai — most-cited papers & profile · Multimodal
← authors
·
overview
Yujun Cai
4
papers ·
0
citations ·
3
h-index
The University of Queensland · Shanghai University of Sport · Reading Museum · University of Reading
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Video-STAR: Reinforcing Open-Vocabulary Action Recognition with Tools
2025
Vision Language Models Map Logos to Text via Semantic Entanglement in the Visual Projector
2025
Cure or Poison? Embedding Instructions Visually Alters Hallucination in Vision-Language Models
2025
Top co-authors
Yiwei Wang
· 2
Chengxuan Qian
· 1
Dapeng Zhang
· 1
Hongkai Chen
· 1
Jing Tang
· 1
Junsong Yuan
· 1
Lei Sun
· 1
Liyang Chen
· 1
Qingwen Ye
· 1
Rui Chen
· 1
Shuo Li
· 1
Sifan Li
· 1
Topics
Video-Language
Visual QA & Reasoning
Vision-Language Models
Benchmarks
Instruction Tuning