Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Arsha Nagrani — most-cited papers & profile · Multimodal
← authors
·
overview
Arsha Nagrani
18
papers ·
501
citations ·
29
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
PaLI-X: On Scaling up a Multilingual Vision and Language Model
2023 · 39 citations
AutoAD-Zero: A Training-Free Framework for Zero-Shot Audio Description
2024 · 12 citations
CRIT: Graph-Based Automatic Data Synthesis to Enhance Cross-Modal Multi-Hop Reasoning
2026
VicTR: Video-conditioned Text Representations for Activity Recognition
2023
Modular Visual Question Answering via Code Generation
2023
Top co-authors
Anurag Arnab
· 2
AJ Piergiovanni
· 1
Alexander Kolesnikov
· 1
Andreas Peter Steiner
· 1
Andrew Zisserman
· 1
Andy Zeng
· 1
Anelia Angelova
· 1
Austin Waters
· 1
Basil Mustafa
· 1
Bo Pang
· 1
Carlos Riquelme Ruiz
· 1
Ceslee Montgomery
· 1
Topics
Vision-Language Models
Visual QA & Reasoning
Video-Language
Benchmarks
Image-Text Retrieval
Audio-Visual