Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Changda Zhou — most-cited papers & profile · Multimodal
← authors
·
overview
Changda Zhou
3
papers ·
0
citations ·
12
h-index
Sun Yat-sen University · First Candle · Baidu (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Real5-OmniDocBench: A Full-Scale Physical Reconstruction Benchmark for Robust Document Parsing in the Wild
2026
Boosting Document Parsing Efficiency and Performance with Coarse-to-Fine Visual Processing
2026
PP-OCRv5: A Specialized 5M-Parameter Model Rivaling Billion-Parameter Vision-Language Models on OCR Tasks
2026
Top co-authors
Tingquan Gao
· 3
Cheng Cui
· 2
Hongen Liu
· 2
Jiaxuan Liu
· 2
Jing Zhang
· 2
Jun Zhang
· 2
Manhui Lin
· 2
Ting Sun
· 2
Xueqing Wang
· 2
Yi Liu
· 2
Yubo Zhang
· 2
Zelun Zhang
· 2
Topics
Vision-Language Models
Benchmarks
Video-Language