Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yu Gu — most-cited papers & profile · Multimodal
← authors
·
overview
Yu Gu
68
papers ·
292
citations ·
22
h-index
University of Science and Technology of China · Hong Kong Polytechnic University · Northeastern University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Lang2Act: Fine-Grained Visual Reasoning through Self-Emergent Linguistic Toolchains
2026
MemoryCard: Topic-Aware Multi-Modal Clue Compression for Long-Video Question Answering
2026
X-Reasoner: Towards Generalizable Reasoning Across Modalities and Domains
2025
Mixture-of-Retrieval Experts for Reasoning-Guided Multimodal Knowledge Exploitation
2025
Road Rage Reasoning with Vision-language Models (VLMs): Task Definition and Evaluation Dataset
2025
HIPPO: Enhancing the Table Understanding Capability of LLMs through Hybrid-Modal Preference Optimization
2025
Top co-authors
Ge Yu
· 4
Yukun Yan
· 4
Zhenghao Liu
· 4
Shuo Wang
· 2
Xinze Li
· 2
Zhipeng Xu
· 2
Chong Chen
· 1
Gang Li
· 1
Guanghui Qin
· 1
Hoifung Poon
· 1
Maosong Sun
· 1
Minghe Yu
· 1
Topics
Visual QA & Reasoning
Vision-Language Models
Benchmarks
Video-Language
Audio-Visual
Image-Text Retrieval