Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Emad Barsoum — most-cited papers & profile · Multimodal
← authors
·
overview
Emad Barsoum
24
papers ·
29
citations ·
6
h-index
Advanced Micro Devices (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models
2025 · 1 citations
DUET-VLM: Dual stage Unified Efficient Token reduction for VLM Training and Inference
2026
Pause and Think: A Dataset and Benchmark for Video-Grounded Assistive Action Suggestion
2026
Athena: Enhancing Multimodal Reasoning with Data-efficient Process Reward Models
2025
Top co-authors
Pratik Prabhanjan Brahma
· 2
Zicheng Liu
· 2
Alan Yuille
· 1
Chao Huang
· 1
Dong Li
· 1
Jiaheng Wei
· 1
Jialian Wu
· 1
Jiang Liu
· 1
Shuai Wang
· 1
Xiaodong Yu
· 1
Ximeng Sun
· 1
Xuanwu Yin
· 1
Topics
Vision-Language Models
Benchmarks
Video-Language
Visual QA & Reasoning
Audio-Visual