Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiangyu Yue — most-cited papers & profile · Multimodal
← authors
·
overview
Xiangyu Yue
18
papers ·
305
citations ·
0
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model
2023 · 119 citations
OneThinker: All-in-one Reasoning Model for Image and Video
2025
MSR-Align: Policy-Grounded Multimodal Alignment for Safety-Aware Reasoning in Vision-Language Models
2025
Mmsi-bench: A Benchmark For Multi-image Spatial Intelligence
2025
PSA-VLM: Enhancing Vision-Language Model Safety through Progressive Concept-Bottleneck-Driven Alignment
2024
RapGuard: Safeguarding Multimodal Large Language Models via Rationale-aware Defensive Prompting
2024
Top co-authors
Yingshui Tan
· 2
Aojun Zhou
· 1
Bo Zheng
· 1
Bo Zheng
· 1
Chenming Zhu
· 1
Chongjun Wang
· 1
Conghui He
· 1
Dahua Lin
· 1
Dian Zheng
· 1
Haodong Duan
· 1
Haoze Sun
· 1
Hongsheng Li
· 1
Topics
Vision-Language Models
Benchmarks
Video-Language
Visual QA & Reasoning
Instruction Tuning