Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jian Wang — most-cited papers & profile · Multimodal
← authors
·
overview
Jian Wang
154
papers ·
769
citations ·
21
h-index
Hunan Police Academy
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
ZRIGF: An Innovative Multimodal Framework for Zero-Resource Image-Grounded Dialogue Generation
2023 · 3 citations
SimpleSearch-VL: A Simple Recipe for Multimodal Agentic Deep Search
2026
Process-of-Thought Reasoning for Videos
2026
MGPC: Multimodal Network for Generalizable Point Cloud Completion With Modality Dropout and Progressive Decoding
2026
MM-CoT:A Benchmark for Probing Visual Chain-of-Thought Reasoning in Multimodal Models
2025
HybridToken-VLM: Hybrid Token Compression for Vision-Language Models
2025
Latent Chain-of-Thought for Visual Reasoning
2025
Less Is More: Lean Yet Powerful Vision-language Model For Autonomous Driving
2025
Gam-agent: Game-theoretic And Uncertainty-aware Collaboration For Complex Visual Reasoning
2025
Accelerating Pre-training of Multimodal LLMs via Chain-of-Sight
2024
Top co-authors
Keze Wang
· 3
Wenhao Chai
· 2
Xiaoyang Guo
· 2
Yijia Fan
· 2
Biao Gong
· 1
Bo Xu
· 1
Bo Zhang
· 1
Guo Chen
· 1
Guohao Sun
· 1
Hang Hua
· 1
Hui Ma
· 1
Jiebo Luo
· 1
Topics
Vision-Language Models
Benchmarks
Visual QA & Reasoning
Embodied & Agents
Video-Language
Image-Text Retrieval