Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xin Zou — most-cited papers & profile · Multimodal
← authors
·
overview
Xin Zou
14
papers ·
1
citations ·
0
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Exploring Response Uncertainty in MLLMs: An Empirical Evaluation under Misleading Scenarios
2024 · 1 citations
Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation
2026
Learning from Fine-Grained Visual Discrepancies: Mitigating Multimodal Hallucinations via In-Context Visual Contrastive Optimization
2026
Consistency as Inductive Bias: Learning Cross-View Invariance for Robust Multimodal Reasoning
2026
When Looking Is Not Enough: Visual Attention Structure Reveals Hallucination in MLLMs
2026
Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models
2026
Sculpting the Vector Space: Towards Efficient Multi-Vector Visual Document Retrieval via Prune-then-Merge Framework
2026
Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering
2026
Don't Just Chase "Highlighted Tokens" in MLLMs: Revisiting Visual Holistic Context Retention
2025
Andesvl Technical Report: An Efficient Mobile-side Multimodal Large Language Model
2025
Docpruner: A Storage-efficient Framework For Multi-vector Visual Document Retrieval Via Adaptive Patch-level Embedding Pruning
2025
Top co-authors
Xuming Hu
· 8
Yibo Yan
· 8
Chen Chen
· 4
Haonan Lu
· 4
Shuliang Liu
· 4
Haolin Deng
· 3
Zhiwei Jin
· 3
Jungang Li
· 2
Aiwei Liu
· 1
Chao Li
· 1
Chao Liu
· 1
Chenxing Li
· 1
Topics
Vision-Language Models
Benchmarks
Visual QA & Reasoning
Image-Text Retrieval
Video-Language
Instruction Tuning