Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yue Zhao — most-cited papers & profile · Multimodal
← authors
·
overview
Yue Zhao
26
papers ·
240
citations ·
0
h-index
Beijing Tsinghua Chang Gung Hospital
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
2025 · 17 citations
Language-image Alignment With Fixed Text Encoders
2025
Interactive Post-Training for Vision-Language-Action Models
2025
Treble Counterfactual VLMs: A Causal Approach to Hallucination
2025
Can Multimodal LLMs Perform Time Series Anomaly Detection?
2025
AutoBench-V: Can Large Vision-Language Models Benchmark Themselves?
2024
Top co-authors
Shawn Li
· 2
Chengxuan Qian
· 1
Han Bao
· 1
Haoran Wang
· 1
Jiashu Qu
· 1
Jiayi Ye
· 1
Jingfeng Yang
· 1
Kairan Dou
· 1
Kai Shu
· 1
Mohamed Elhoseiny
· 1
Philipp Kr\"ahenb\"uhl
· 1
Philip S. Yu
· 1
Topics
Vision-Language Models
Benchmarks
Video-Language
Embodied & Agents
Visual QA & Reasoning
Audio-Visual
Image-Text Retrieval