Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiaoshuai Sun — most-cited papers & profile · Multimodal
← authors
·
overview
Xiaoshuai Sun
18
papers ·
106
citations ·
40
h-index
Jimei University · Xiamen University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Cheap and Quick: Efficient Vision-Language Instruction Tuning for Large Language Models
2023 · 45 citations
ControlMLLM: Training-Free Visual Prompt Learning for Multimodal Large Language Models
2024 · 1 citations
CIR-CoT: Towards Interpretable Composed Image Retrieval via End-to-End Chain-of-Thought Reasoning
2025
Adapting Pre-trained Language Models to Vision-Language Tasks via Dynamic Visual Prompting
2023
Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models
2024
Accelerating Multimodal Large Language Models via Dynamic Visual-Token Exit and the Empirical Findings
2024
Top co-authors
Rongrong Ji
· 4
Jiayi Ji
· 2
Mingrui Wu
· 2
Rongrong Ji
· 2
Yiyi Zhou
· 2
Gen Luo
· 1
Gen Luo
· 1
Guannan Jiang
· 1
Hao Fei
· 1
Jiale Li
· 1
Jiale Li
· 1
Jiayi Ji
· 1
Topics
cs.CV
Vision-Language Models
Video-Language
Visual QA & Reasoning
Instruction Tuning
Audio-Visual
Benchmarks
cs.CL
cs.LG
cs.MM