Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Dinesh Manocha — most-cited papers & profile · Multimodal
← authors
·
overview
Dinesh Manocha
67
papers ·
80
citations ·
91
h-index
University of North Carolina at Chapel Hill · University of Maryland, College Park
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Bi-VLM: Pushing Ultra-Low Precision Post-Training Quantization Boundaries in Vision-Language Models
2025
MAGNET: A Multi-agent Framework For Finding Audio-visual Needles By Reasoning Over Multi-video Haystacks
2025
Do Vision-Language Models Understand Compound Nouns?
2024
Meerkat: Audio-Visual Large Language Model for Grounding in Space and Time
2024
Towards a Systematic Evaluation of Hallucinations in Large-Vision Language Models
2024
Top co-authors
Mohamed Elhoseiny
· 2
Sanjoy Chowdhury
· 2
Sayan Nag
· 2
Ashish Seth
· 1
Chengyuan Zhang
· 1
Chirag Agarwal
· 1
Jun Chen
· 1
Junjie Fei
· 1
Junyun Huang
· 1
Mohamed Elmoghany
· 1
Rayyan Abdalla
· 1
Ruiqi Xian
· 1
Topics
Benchmarks
Vision-Language Models
Video-Language
Visual QA & Reasoning
Audio-Visual
cs.CV
cs.CL
Instruction Tuning
cs.AI