Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Ying Wang — most-cited papers & profile · Multimodal
← authors
·
overview
Ying Wang
73
papers ·
210
citations ·
10
h-index
Xinjiang Normal University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Visual Explanations of Image-Text Representations via Multi-Modal Information Bottleneck Attribution
2023 · 4 citations
ERNIE 5.0 Technical Report
2026 · 2 citations
If-bench: Benchmarking And Enhancing Mllms For Infrared Images With Generative Visual Prompting
2025
Evovlma: Evolutionary Vision-language Model Adaptation
2025
Realtime-VLA FLASH: Speculative Inference Framework for Diffusion-based VLAs
2026
WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering
2026
Beyond Sequential Distance: Inter-Modal Distance Invariant Position Encoding
2026
Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions
2026
CC-VQA: Conflict- and Correlation-Aware Method for Mitigating Knowledge Conflict in Knowledge-Based Visual Question Answering
2026
Knowledge-based Visual Question Answer with Multimodal Processing, Retrieval and Filtering
2025
Top co-authors
Kun Ding
· 7
Shiming Xiang
· 6
Qi Yang
· 3
Bo Zhang
· 2
Jieping Ye
· 2
Lin Chen
· 2
Yue Wu
· 2
Yuyang Hong
· 2
Zili Wang
· 2
Andrew Gordon Wilson
· 1
Bingjin Chen
· 1
Bin Li
· 1
Topics
Vision-Language Models
Audio-Visual
Visual QA & Reasoning
Video-Language
Benchmarks
Image-Text Retrieval
Embodied & Agents
Instruction Tuning