Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Qi Liu — most-cited papers & profile · Multimodal
← authors
·
overview
Qi Liu
186
papers ·
1034
citations ·
12
h-index
Tianjin University of Technology and Education · Tianjin University of Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
M$^3$IT: A Large-Scale Dataset towards Multi-Modal Multilingual Instruction Tuning
2023 · 14 citations
MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering
2024 · 5 citations
VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models
2024 · 2 citations
Multimodal ArXiv: A Dataset for Improving Scientific Comprehension of Large Vision-Language Models
2024 · 1 citations
TextSquare: Scaling up Text-Centric Visual Instruction Tuning
2024 · 1 citations
DeepScan: A Training-Free Framework for Visually Grounded Reasoning in Large Vision-Language Models
2026
Towards Interpretable Hallucination Analysis and Mitigation in LVLMs via Contrastive Neuron Steering
2026
Revealing and Enhancing Core Visual Regions: Harnessing Internal Attention Dynamics for Hallucination Mitigation in LVLMs
2026
OIG-Bench: A Multi-Agent Annotated Benchmark for Multimodal One-Image Guides Understanding
2025
Perception-R1: Advancing Multimodal Reasoning Capabilities of MLLMs via Visual Perception Reward
2025
Top co-authors
Lingpeng Kong
· 4
Lei Li
· 3
Peiyi Wang
· 3
Can Huang
· 2
Cheng Deng
· 2
Chunhui Lin
· 2
Hao Feng
· 2
Hao Liu
· 2
Jingqun Tang
· 2
Kuan Lu
· 2
Mukai Li
· 2
Shu Wei
· 2
Topics
Vision-Language Models
Visual QA & Reasoning
Benchmarks
Video-Language
Instruction Tuning
Embodied & Agents
Image-Text Retrieval