Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yuhao Dong — most-cited papers & profile · Multimodal
← authors
·
overview
Yuhao Dong
4
papers ·
2
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Chain-of-Spot: Interactive Reasoning Improves Large Vision-Language Models
2024 · 1 citations
Insight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models
2024 · 1 citations
High-Resolution Visual Reasoning via Multi-Turn Grounding-Based Reinforcement Learning
2025
Talk2event: Grounded Understanding Of Dynamic Scenes From Event Cameras
2025
Top co-authors
Yongming Rao
· 2
Zuyan Liu
· 2
Ao Liang
· 1
Benoit R. Cottereau
· 1
Bo Li
· 1
Dongyue Lu
· 1
Hai-Long Sun
· 1
Jie Zhou
· 1
Jingkang Yang
· 1
Jiwen Lu
· 1
Lai Xing Ng
· 1
Lingdong Kong
· 1
Topics
Vision-Language Models
Visual QA & Reasoning
Video-Language
Benchmarks
Audio-Visual
Instruction Tuning
Embodied & Agents