Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiatian Zhu — most-cited papers & profile · Multimodal
← authors
·
overview
Xiatian Zhu
29
papers ·
426
citations ·
53
h-index
University of Surrey
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
FashionViL: Fashion-Focused Vision-and-Language Representation Learning
2022 · 4 citations
FAME-ViL: Multi-Tasking Vision-Language Model for Heterogeneous Fashion Tasks
2023 · 2 citations
Multi-Modal Few-Shot Temporal Action Detection
2022 · 1 citations
Retrieving-to-Answer: Zero-Shot Video Question Answering with Frozen Large Language Models
2023
Top co-authors
Tao Xiang
· 3
Yi-Zhe Song
· 3
Licheng Yu
· 2
Li Zhang
· 2
Bernard Ghanem
· 1
Hongsheng Li
· 1
Juan-Manuel Perez-Rua
· 1
Junting Pan
· 1
Mengmeng Xu
· 1
Renrui Zhang
· 1
Sauradip Nag
· 1
Xiao Han
· 1
Topics
Vision-Language Models
Video-Language
Image-Text Retrieval
Visual QA & Reasoning
Benchmarks