Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Zhihao Fan — most-cited papers & profile · Multimodal
← authors
·
overview
Zhihao Fan
3
papers ·
162
citations ·
15
h-index
Zhengzhou University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
2024 · 81 citations
DELAN: Dual-Level Alignment for Vision-and-Language Navigation by Cross-Modal Contrastive Learning
2024
Top co-authors
Mengfei Du
· 2
Binhao Wu
· 1
Chang Zhou
· 1
Dayiheng Liu
· 1
Jialin Wang
· 1
Jingren Zhou
· 1
Jinze Bai
· 1
Jiwen Zhang
· 1
Junyang Lin
· 1
Kai Dang
· 1
Keqin Chen
· 1
Peng Wang
· 1
Topics
Vision-Language Models
Video-Language
Benchmarks
Embodied & Agents