Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Heng Ji — most-cited papers & profile · Multimodal
← authors
·
overview
Heng Ji
17
papers ·
92
citations ·
45
h-index
HBIS (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Measuring and Improving Chain-of-Thought Reasoning in Vision-Language Models
2023 · 1 citations
Rethinking Task Sampling for Few-shot Vision-Language Transfer Learning
2022
Enhanced Chart Understanding in Vision and Language Task via Cross-modal Pre-training on Plot Table Pairs
2023
Visually Descriptive Language Model for Vector Graphics Reasoning
2024
Top co-authors
Ajay Divakaran
· 1
Christopher Thomas
· 1
Hang Yu
· 1
Han Zhao
· 1
Jiajun Wu
· 1
Joy Hsu
· 1
Karan Sikka
· 1
Kuan-Hao Huang
· 1
Long Chen
· 1
Manling Li
· 1
Manling Li
· 1
Michael Cogswell
· 1
Topics
Vision-Language Models
Video-Language
Visual QA & Reasoning
Benchmarks