Awesome Reinforcement Learning
๐
Papers
๐งญ
Topics
๐ฅ
Trending
๐บ๏ธ
Map
๐
Leaderboards
๐
Learn
๐ค
Ask AI
โฏ
More
๐ฅ
Authors
๐
Reading Packs
๐
Datasets
๐ ๏ธ
Tools
๐ฐ
News
๐
Blogs
โ๏ธ
Newsletter
๐ฏ
Research Radar
๐
Saved
+ Add Paper
โพ
โ
โ authors
ยท
overview
Loading authorโฆ
๐ค
Ask AI
Zhuoran Yang โ most-cited papers & profile ยท Reinforcement Learning
โ authors
ยท
overview
Zhuoran Yang
95
papers ยท
1599
citations ยท
29
h-index
Civil Aviation University of China ยท Yale University
Google Scholar โ
Semantic Scholar โ
OpenAlex โ
Most-cited papers
Fully Decentralized Multi-Agent Reinforcement Learning with Networked Agents
2018 ยท 250 citations
Provably Efficient Reinforcement Learning with Linear Function Approximation
2019 ยท 219 citations
Parametrized Deep Q-Networks Learning: Reinforcement Learning with Discrete-Continuous Hybrid Action Space
2018 ยท 152 citations
A Theoretical Analysis of Deep Q-Learning
2019 ยท 132 citations
Multi-Agent Reinforcement Learning: A Selective Overview of Theories and Algorithms
2019 ยท 124 citations
Multi-Agent Reinforcement Learning via Double Averaging Primal-Dual Optimization
2018 ยท 119 citations
Neural Proximal/Trust Region Policy Optimization Attains Globally Optimal Policy
2019 ยท 60 citations
A Communication-Efficient Multi-Agent Actor-Critic Algorithm for Distributed Reinforcement Learning
2019 ยท 38 citations
Provably Efficient Safe Exploration via Primal-Dual Policy Optimization
2020 ยท 35 citations
Convergent Policy Optimization for Safe Reinforcement Learning
2019 ยท 31 citations
Policy Optimization Provably Converges to Nash Equilibria in Zero-Sum Linear Quadratic Games
2019 ยท 28 citations
Is Pessimism Provably Efficient for Offline RL?
2020 ยท 25 citations
Pessimistic Bootstrapping for Uncertainty-Driven Offline Reinforcement Learning
2022 ยท 24 citations
Neural Policy Gradient Methods: Global Optimality and Rates of Convergence
2019 ยท 19 citations
Actor-Critic Provably Finds Nash Equilibria of Linear-Quadratic Mean-Field Games
2019 ยท 19 citations
Top co-authors
Zhaoran Wang
ยท 49
Zhaoran Wang
ยท 21
Kaiqing Zhang
ยท 8
Lingxiao Wang
ยท 8
Michael I. Jordan
ยท 8
Qi Cai
ยท 8
Shuang Qiu
ยท 7
Xiaohan Wei
ยท 6
Zuyue Fu
ยท 6
Han Zhong
ยท 5
Mengdi Wang
ยท 5
Chenjia Bai
ยท 4
Topics
Model-Based RL
Multi-Agent
Value-Based
Policy Gradient
Game AI
Offline RL
Exploration
Safe RL
RLHF & Alignment
Meta-RL