Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Weihao Xuan — most-cited papers & profile · Multimodal
← authors
·
overview
Weihao Xuan
5
papers ·
3
citations ·
9
h-index
RIKEN Center for Advanced Intelligence Project · The University of Tokyo
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Disasterm3: A Remote Sensing Vision-language Dataset For Disaster Damage Assessment And Response
2025 · 3 citations
Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models
2025
Dynamicvl: Benchmarking Multimodal Large Language Models For Dynamic City Understanding
2025
Top co-authors
Junjue Wang
· 3
Naoto Yokoya
· 3
Heli Qi
· 2
Junshi Xia
· 2
Zhuo Zheng
· 2
Heli Qi
· 1
Hongruixuan Chen
· 1
Jian Song
· 1
Kunyi Liu
· 1
Qingcheng Zeng
· 1
Yanfei Zhong
· 1
Yuhan Wu
· 1
Topics
Vision-Language Models
Video-Language
Benchmarks
Visual QA & Reasoning