Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Qi Li — most-cited papers & profile · Multimodal
← authors
·
overview
Qi Li
61
papers ·
417
citations ·
27
h-index
Chinese Academy of Sciences · Nantong University · Rex Medical (United States) · Institute of Automation · Sichuan Normal University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Instructvton: Optimal Auto-masking And Natural-language-guided Interactive Style Control For Inpainting-based Virtual Try-on
2025
VisualSimpleQA: A Benchmark for Decoupled Evaluation of Large Vision-Language Models in Fact-Seeking Question Answering
2025
Top co-authors
Haoyang Li
· 1
Jing Zhang
· 1
Julien Han
· 1
Ke Xu
· 1
Lixin Liu
· 1
Shasha Guo
· 1
Shuwen Qiu
· 1
Xiaodong Chen
· 1
Yanling Wang
· 1
Yihan Zhao
· 1
Yong Xiao
· 1
Topics
Vision-Language Models
Video-Language
Instruction Tuning
Benchmarks
Audio-Visual
Visual QA & Reasoning