Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Zuhao Yang — most-cited papers & profile · Multimodal
← authors
·
overview
Zuhao Yang
10
papers ·
0
citations ·
3
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Longvt: Incentivizing "thinking With Long Videos" Via Native Tool Calling
2025
SVAgent: Storyline-Guided Long Video Understanding via Cross-Modal Multi-Agent Collaboration
2026
Beyond SFT-to-RL: Pre-alignment via Black-Box On-Policy Distillation for Multimodal RL
2026
A Comprehensive Study on Visual Token Redundancy for Discrete Diffusion-based Multimodal Large Language Models
2025
Todre: Effective Visual Token Pruning Via Token Diversity And Task Relevance
2025
Top co-authors
Shijian Lu
· 2
Angang Du
· 1
Beier Zhu
· 1
Bin Zhao
· 1
Bohong Yin
· 1
Bowei Xing
· 1
Bowen Qu
· 1
Boxiao Liu
· 1
Chao Hong
· 1
Chaojun Xiao
· 1
Chen Chen
· 1
Cheng Li
· 1
Topics
Visual QA & Reasoning
Vision-Language Models
Video-Language
Benchmarks
Embodied & Agents
Audio-Visual