Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Weiran Huang — most-cited papers & profile · Multimodal
← authors
·
overview
Weiran Huang
26
papers ·
76
citations ·
17
h-index
Shanghai Jiao Tong University · Beijing Academy of Artificial Intelligence · Shanghai Artificial Intelligence Laboratory
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MM-LIMA: Less Is More for Alignment in Multi-Modal Datasets
2023 · 7 citations
TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones
2023 · 7 citations
Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
2026
Attend to Evidence: Evidence-Anchored Spatial Attention Supervision for Multimodal RLVR
2026
Revisiting Visual Understanding in Multimodal Reasoning through a Lens of Image Perturbation
2025
Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start
2025
First SFT, Second RL, Third UPT: Continual Improving Multi-Modal LLM Reasoning via Unsupervised Post-Training
2025
Enhanced Continual Learning of Vision-Language Models with Model Fusion
2025
ATLAS: Adapter-Based Multi-Modal Continual Learning with a Two-Stage Learning Strategy
2024
Top co-authors
Lai Wei
· 6
Lichao Sun
· 5
Linghe Kong
· 5
Yue Wang
· 4
Chen Wang
· 3
Yuting Li
· 3
Bo Wang
· 2
Kaipeng Zheng
· 2
Bin Yu
· 1
Huijia Zhu
· 1
Jingyuan Huang
· 1
Kai Wang
· 1
Topics
Vision-Language Models
Visual QA & Reasoning
Benchmarks
Video-Language
Instruction Tuning
Image-Text Retrieval
Audio-Visual