Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiaopeng Zhang — most-cited papers & profile · Multimodal
← authors
·
overview
Xiaopeng Zhang
8
papers ·
941
citations ·
46
h-index
Chinese Academy of Sciences · Shandong Institute of Automation · University of Chinese Academy of Sciences · Beihang University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
ParaUni: Enhance Generation in Unified Multimodal Model with Reinforcement-driven Hierarchical Parallel Information Interaction
2025
Explicit Temporal-Semantic Modeling for Dense Video Captioning via Context-Aware Cross-Modal Interaction
2025
GranViT: A Fine-Grained Vision Model With Autoregressive Perception For MLLMs
2025
Top co-authors
Bowen Shi
· 1
Feng Zhao
· 1
Guanghao Zheng
· 1
Hongkai Xiong
· 1
Jiangtong Tan
· 1
Jie Huanng
· 1
Jiguang Zhang
· 1
Junni Zou
· 1
Lin Liu
· 1
Mingda Jia
· 1
Mingxing Xu
· 1
Peisen Zhao
· 1
Topics
Vision-Language Models
cs.CV
Video-Language
Image-Text Retrieval
Visual QA & Reasoning
Benchmarks