Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jiawei Chen — most-cited papers & profile · Multimodal
← authors
·
overview
Jiawei Chen
126
papers ·
913
citations ·
30
h-index
Fudan University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MISS: A Generative Pretraining and Finetuning Approach for Med-VQA
2024 · 4 citations
From Pixels to Tokens: Revisiting Object Hallucinations in Large Vision-Language Models
2024 · 1 citations
DeepScan: A Training-Free Framework for Visually Grounded Reasoning in Large Vision-Language Models
2026
Mindwatcher: Toward Smarter Multimodal Tool-integrated Reasoning
2025
Who Can See Through You? Adversarial Shielding Against Vlm-based Attribute Inference Attacks
2025
Mla-trust: Benchmarking Trustworthiness Of Multimodal LLM Agents In GUI Environments
2025
MIRG-RL: Multi-image Reasoning And Grounding With Reinforcement Learning
2025
Heptapod: Language Modeling On Visual Signals
2025
Large Vision-Language Models as Emotion Recognizers in Context Awareness
2024
Top co-authors
Dingkang Yang
· 2
Lihao Zheng
· 2
Lihua Zhang
· 2
Xintian Shen
· 2
Yu Tian
· 2
Yuxuan Lei
· 2
Hongjian Zhan
· 1
Jingyuan Zhang
· 1
Jun Luo
· 1
Peng Zhai
· 1
Qi Liu
· 1
Xiao Yang
· 1
Topics
Vision-Language Models
Benchmarks
Visual QA & Reasoning
Video-Language
Embodied & Agents
Instruction Tuning