Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jinxing Zhou — most-cited papers & profile · Multimodal
← authors
·
overview
Jinxing Zhou
12
papers ·
3
citations ·
33
h-index
Henan Provincial People's Hospital
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
CLASP: Cross-modal Salient Anchor-based Semantic Propagation For Weakly-supervised Dense Audio-visual Event Localization
2025 · 1 citations
MAviS: A Multimodal Conversational Assistant For Avian Species
2026
A Benchmark and Agentic Framework for Omni-Modal Reasoning and Tool Use in Long Videos
2025
User-feedback-driven Adaptation For Vision-and-language Navigation
2025
Self-Consistency as a Free Lunch: Reducing Hallucinations in Vision-Language Models via Self-Reflection
2025
Think Before You Segment: An Object-aware Reasoning Agent for Referring Audio-Visual Segmentation
2025
Composed Object Retrieval: Object-level Retrieval via Composed Expressions
2025
Simtoken: A Simple Baseline For Referring Audio-visual Segmentation
2025
Fine-grained Audible Video Description
2023
Object-aware Adaptive-Positivity Learning for Audio-Visual Question Answering
2023
Top co-authors
Hisham Cholakkal
· 3
Salman Khan
· 3
Xiaojun Chang
· 3
Yanghao Zhou
· 3
Fahad Shahbaz Khan
· 2
Meng Wang
· 2
Mingfei Han
· 2
Mohammed Irfan Kurpath
· 2
Rao Muhammad Anwer
· 2
Sahal Shaji Mullappilly
· 2
Tong Wang
· 2
Aixuan Li
· 1
Topics
Audio-Visual
Video-Language
Visual QA & Reasoning
Benchmarks
Vision-Language Models
Instruction Tuning
Embodied & Agents
Image-Text Retrieval