Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yangchen Pan — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Yangchen Pan
16
papers ·
70
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Maxmin Q-learning: Controlling the Estimation Bias of Q-learning
2020 · 38 citations
Hill Climbing on Value Estimates for Search-control in Dyna
2019 · 8 citations
Reinforcement Learning with Function-Valued Action Spaces for Partial Differential Equation Control
2018 · 5 citations
Memory-efficient Reinforcement Learning with Value-based Knowledge Consolidation
2022 · 4 citations
Greedy Actor-Critic: A New Conditional Cross-Entropy Method for Policy Improvement
2018 · 3 citations
The In-Sample Softmax for Offline Reinforcement Learning
2023 · 3 citations
An Alternative to Variance: Gini Deviation for Risk-averse Policy Gradient
2023 · 3 citations
Frequency-based Search-control in Dyna
2020 · 2 citations
DTR-Bench: An in silico Environment and Benchmark Platform for Reinforcement Learning Based Dynamic Treatment Regime
2024 · 2 citations
Conditionally Optimistic Exploration for Cooperative Deep Multi-Agent Reinforcement Learning
2023 · 1 citations
An Alternate Policy Gradient Estimator for Softmax Policies
2021
A Simple Mixture Policy Parameterization for Improving Sample Efficiency of CVaR Optimization
2024
An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models
2024
Reinforcement Learning in Dynamic Treatment Regimes Needs Critical Reexamination
2024
Top co-authors
Martha White
· 6
Amir-massoud Farahmand
· 3
Chenjun Xiao
· 3
Adam White
· 2
A. Rupam Mahmood
· 2
Pascal Poupart
· 2
Philip Torr
· 2
Qingfeng Lan
· 2
Tingting Zhu
· 2
Yudong Luo
· 2
Zhiyao Luo
· 2
Ajin Joseph
· 1
Topics
Value-Based
Policy Gradient
Model-Based RL
Exploration
Offline RL
Safe RL
Multi-Agent