Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yezhou Yang — most-cited papers & profile · Multimodal
← authors
·
overview
Yezhou Yang
11
papers ·
37
citations ·
33
h-index
Arizona State University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
REVISION: Rendering Tools Enable Spatial Fidelity in Vision-Language Models
2024 · 2 citations
Good, Better, Best: Textual Distractors Generation for Multiple-Choice Visual Question Answering via Reinforcement Learning
2019 · 1 citations
CounterVid: Counterfactual Video Generation for Mitigating Action and Temporal Hallucinations in Video-Language Models
2026
VL-GLUE: A Suite of Fundamental yet Challenging Visuo-Linguistic Reasoning Tasks
2024
Top co-authors
Chitta Baral
· 2
Agneet Chatterjee
· 1
Amanmeet Garg
· 1
Burak Uzkent
· 1
Florian Schiffers
· 1
Garin Kessler
· 1
Jiaying Lu
· 1
Kartik Aggarwal
· 1
Lorenzo Baraldi
· 1
Lucas Porto
· 1
Marcella Cornia
· 1
Mutsumi Nakamura
· 1
Topics
Vision-Language Models
Benchmarks
Visual QA & Reasoning
Video-Language