Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yu Liu — most-cited papers & profile · Multimodal
← authors
·
overview
Yu Liu
166
papers ·
3464
citations ·
41
h-index
Guangzhou University · Southwest Jiaotong University · Tsinghua University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning
2024 · 9 citations
Enhancing Vision-Language Model with Unmasked Token Alignment
2024 · 1 citations
MM-Instruct: Generated Visual Instructions for Large Multimodal Model Alignment
2024 · 1 citations
Missing No More: Dictionary-Guided Cross-Modal Image Fusion under Missing Infrared
2026
DM0: An Embodied-Native Vision-Language-Action Model towards Physical AI
2026
A Unified Framework for Emotion Recognition and Sentiment Analysis via Expert-Guided Multimodal Fusion with Large Language Models
2026
Cross-modal Proxy Evolving for OOD Detection with Vision-Language Models
2026
Uni-RS: A Spatially Faithful Unified Understanding and Generation Model for Remote Sensing
2026
MME-CC: A Challenging Multi-Modal Evaluation Benchmark of Cognitive Capacity
2025
Think-before-draw: Decomposing Emotion Semantics & Fine-grained Controllable Expressive Talking Head Generation
2025
MiCo: Multi-image Contrast for Reinforcement Visual Reasoning
2025
DecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning
2024
Top co-authors
Hongsheng Li
· 3
Boxiao Liu
· 2
Chaoyi Huang
· 1
Chaoyou Fu
· 1
Chenghao Yang
· 1
Daxin Jiang
· 1
En Yu
· 1
Fan Jia
· 1
Fei Shen
· 1
Ge Zhang
· 1
Guanglu Song
· 1
Guang Shi
· 1
Topics
Vision-Language Models
Benchmarks
Video-Language
Visual QA & Reasoning
Audio-Visual
Embodied & Agents
Instruction Tuning
cs.CV
cs.MM
Image-Text Retrieval