Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yuhao Ding — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Yuhao Ding
12
papers ·
19
citations ·
12
h-index
Nanjing Tech University · Vital Strategies · Hangzhou Dianzi University · University of California, Berkeley
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
2024 · 9 citations
A Dual Approach to Constrained Markov Decision Processes with Entropy Regularization
2021 · 4 citations
A CMDP-within-online framework for Meta-Safe Reinforcement Learning
2024 · 2 citations
Beyond Exact Gradients: Convergence of Stochastic Soft-Max Policy Gradient Methods with Entropy Regularization
2021 · 1 citations
Policy-based Primal-Dual Methods for Concave CMDP with Variance Reduction
2022 · 1 citations
Scalable Multi-Agent Reinforcement Learning with General Utilities
2023 · 1 citations
Scalable Primal-Dual Actor-Critic Method for Safe Multi-Agent RL with General Utilities
2023 · 1 citations
On the Global Optimum Convergence of Momentum-based Policy Gradient
2021
Provably Efficient Primal-Dual Reinforcement Learning for CMDPs with Non-stationary Objectives and Constraints
2022
Non-stationary Risk-sensitive Reinforcement Learning: Near-optimal Dynamic Regret, Adaptive Detection, and Separation Design
2022
Tempo Adaptation in Non-stationary Reinforcement Learning
2023
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
2024
Top co-authors
Javad Lavaei
· 9
Donghao Ying
· 4
Bilgehan Sel
· 3
Ming Jin
· 3
Alec Koppel
· 2
Alois Knoll
· 2
Hyunin Lee
· 2
Junzi Zhang
· 2
Ming Jin
· 2
Qingwei Lin
· 2
Shangding Gu
· 2
Hyunin Lee
· 1
Topics
Safe RL
Policy Gradient
Exploration
Meta-RL
Multi-Agent
Value-Based
Model-Based RL