Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Zhaochen Yu — most-cited papers & profile · Multimodal
← authors
·
overview
Zhaochen Yu
9
papers ·
103
citations ·
2
h-index
Peking University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Buffer Of Thoughts: Thought-augmented Reasoning With Large Language Models
2024 · 95 citations
VideoTetris: Towards Compositional Text-to-Video Generation
2024 · 5 citations
RealCompo: Balancing Realism and Compositionality Improves Text-to-Image Diffusion Models
2024 · 2 citations
Contextualized Diffusion Models for Text-Guided Image and Video Generation
2024 · 1 citations
Demystifying Reinforcement Learning In Agentic Reasoning
2025
Demystifying Reinforcement Learning in Agentic Reasoning
2025
Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs
2024
Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models
2024
SuperCorrect: Supervising and Correcting Language Models with Error-Driven Insights
2024
Topics
Model Architecture
Training Techniques
Efficiency
Diffusion Models
Text-to-Image
Text-to-Video
In-Context Learning
Prompting
Audio Generation
3D & NeRF Generation