Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Zuhao Yang — most-cited papers & profile · Multimodal
← authors
·
overview
Zuhao Yang
5
papers ·
0
citations ·
3
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Longvt: Incentivizing "thinking With Long Videos" Via Native Tool Calling
2025
SVAgent: Storyline-Guided Long Video Understanding via Cross-Modal Multi-Agent Collaboration
2026
Beyond SFT-to-RL: Pre-alignment via Black-Box On-Policy Distillation for Multimodal RL
2026
Top co-authors
Beier Zhu
· 1
Chaojun Xiao
· 1
Chen Chen
· 1
Chengwei Qin
· 1
Hehai Lin
· 1
Keming Wu
· 1
K. Zhang
· 1
Lidong Bing
· 1
Shijian Lu
· 1
Shuo Zhan
· 1
S. H. Wang
· 1
Sicong Leng
· 1
Topics
Visual QA & Reasoning
Video-Language
Benchmarks
Embodied & Agents
Vision-Language Models