Awesome Multimodal
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Qihang Zhang β most-cited papers & profile Β· Multimodal
β authors
Β·
overview
Qihang Zhang
13
papers Β·
14
citations Β·
5
h-index
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
Hundreds Guide Millions: Adaptive Offline Reinforcement Learning with Expert Guidance
2023 Β· 9 citations
Towards Smooth Video Composition
2022 Β· 2 citations
Towards Smooth Video Composition
2022 Β· 2 citations
MetaDrive: Composing Diverse Driving Scenarios for Generalizable Reinforcement Learning
2021 Β· 1 citations
Explicit Critic Guidance for Aligning Diffusion Models
2026
Next Forcing: Causal World Modeling with Multi-Chunk Prediction
2026
Causal World Modeling for Robot Control
2026
BulletTime: Decoupled Control of Time and Camera Pose for Video Generation
2025
Learning to Drive by Watching YouTube Videos: Action-Conditioned Contrastive Policy Pretraining
2022
Learning to Drive by Watching YouTube Videos: Action-Conditioned Contrastive Policy Pretraining
2022
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
2024
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
2024
World-consistent Video Diffusion with Explicit 3D Modeling
2024
Topics
Diffusion Models
3D & NeRF Generation
Text-to-Video
Control
Audio Generation
Safe RL
Offline RL
Model-Based RL
Image Generation
cs.LG