Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jun Chen — most-cited papers & profile · Multimodal
← authors
·
overview
Jun Chen
3
papers ·
69
citations ·
25
h-index
Hainan University · Beijing Advanced Sciences and Innovation Center
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning
2023 · 66 citations
CommerceMM: Large-Scale Commerce MultiModal Representation Learning with Omni Retrieval
2022 · 3 citations
Meerkat: Audio-Visual Large Language Model for Grounding in Space and Time
2024
Top co-authors
Mohamed Elhoseiny
· 2
Animesh Sinha
· 1
Deyao Zhu
· 1
Dinesh Manocha
· 1
Hugo Chen
· 1
Licheng Yu
· 1
Mengjiao MJ Wang
· 1
Ning Zhang
· 1
Pengchuan Zhang
· 1
Raghuraman Krishnamoorthi
· 1
Ruohan Gao
· 1
Sanjoy Chowdhury
· 1
Topics
Vision-Language Models
Instruction Tuning
Image-Text Retrieval
Video-Language
Visual QA & Reasoning
Audio-Visual
Benchmarks