Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Long Li — most-cited papers & profile · Multimodal
← authors
·
overview
Long Li
29
papers ·
13
citations ·
12
h-index
Shanghai Urban Transportation Design Institute (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Lingshu: A Generalist Foundation Model For Unified Multimodal Medical Understanding And Reasoning
2025 · 5 citations
Saliency-R1: Incentivizing Unified Saliency Reasoning Capability in MLLM with Confidence-Guided Reinforcement Learning
2025
Perception Before Reasoning: Two-Stage Reinforcement Learning for Visual Reasoning in Vision-Language Models
2025
Eoc-bench: Can Mllms Identify, Recall, And Forecast Objects In An Egocentric World?
2025
ECBench: Can Multi-modal Foundation Models Understand the Egocentric World? A Holistic Embodied Cognition Benchmark
2025
Top co-authors
Yuqian Yuan
· 2
Chaojun Wang
· 1
Chaoqun Liu
· 1
Chenghao Xiao
· 1
Deli Zhao
· 1
Dingwen Zhang
· 1
Guizhen Chen
· 1
Hao Zhang
· 1
Hou Pong Chan
· 1
Jianyu Wang
· 1
Jie Tan
· 1
Jingdong Wang
· 1
Topics
Visual QA & Reasoning
Vision-Language Models
Benchmarks
Embodied & Agents
Video-Language