Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yang Yu — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Yang Yu
25
papers ·
90
citations ·
20
h-index
Beijing Botanical Garden · Education University of Hong Kong · University of Chinese Academy of Sciences
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
A Survey on Model-based Reinforcement Learning
2022 · 26 citations
Communication-Robust Multi-Agent Learning by Adaptable Auxiliary Multi-Agent Adversary Generation
2023 · 13 citations
Offline Reinforcement Learning with Causal Structured World Models
2022 · 8 citations
Natural Language-conditioned Reinforcement Learning with Inside-out Task Language Development and Translation
2023 · 3 citations
Fast Teammate Adaptation in the Presence of Sudden Policy Change
2023 · 3 citations
Policy Regularization with Dataset Constraint for Offline Reinforcement Learning
2023 · 3 citations
Self-Motivated Multi-Agent Exploration
2023 · 2 citations
Value Activation for Bias Alleviation: Generalized-activated Deep Double Deterministic Policy Gradients
2021 · 1 citations
Hybrid Value Estimation for Off-policy Evaluation and Offline Reinforcement Learning
2022 · 1 citations
Unified Policy Optimization for Continuous-action Reinforcement Learning in Non-stationary Tasks and Games
2022 · 1 citations
Efficient Communication via Self-supervised Information Aggregation for Online and Offline Multi-agent Reinforcement Learning
2023 · 1 citations
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
2025
Model Generation with Provable Coverability for Offline Reinforcement Learning
2022
Model-based Reinforcement Learning with Multi-step Plan Value Estimation
2022
Multi-agent Continual Coordination via Progressive Task Contextualization
2023
Top co-authors
Lei Yuan
· 6
Zongzhang Zhang
· 5
Chengxing Jia
· 3
Cong Guan
· 3
Chenjun Xiao
· 2
Chen-Xiao Gao
· 2
Fan-Ming Luo
· 2
Fuxiang Zhang
· 2
Haoxin Lin
· 2
Jiaji Zhang
· 2
Xiong-Hui Chen
· 2
Yi-Chen Li
· 2
Topics
Offline RL
Policy Gradient
Model-Based RL
Multi-Agent
Value-Based
Exploration
Safe RL
Meta-RL
RLHF & Alignment
Game AI