Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Lifeng Shang — most-cited papers & profile · Multimodal
← authors
·
overview
Lifeng Shang
30
papers ·
154
citations ·
33
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Enabling Multimodal Generation on CLIP via Vision-Language Knowledge Distillation
2022 · 4 citations
Dream-VL & Dream-VLA: Open Vision-Language and Vision-Language-Action Models with Diffusion Language Model Backbone
2025
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
2025
Top co-authors
Haoli Bai
· 2
Lu Hou
· 2
Qun Liu
· 2
Chaofan Tao
· 1
Fei Mi
· 1
Jiacheng Ye
· 1
Jiahui Gao
· 1
Jiannan Wu
· 1
Jierun Chen
· 1
Lei Zhu
· 1
Lewei Yao
· 1
Lingpeng Kong
· 1
Topics
Vision-Language Models
Video-Language
Benchmarks
Visual QA & Reasoning
Embodied & Agents