Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Ping-Chun Hsieh — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Ping-Chun Hsieh
18
papers ·
19
citations ·
9
h-index
National Yang Ming Chiao Tung University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Efficient Action-Constrained Reinforcement Learning via Acceptance-Rejection Method and Augmented MDPs
2025 · 7 citations
Escaping from Zero Gradient: Revisiting Action-Constrained Reinforcement Learning via Frank-Wolfe Policy Optimization
2021 · 3 citations
NeurWIN: Neural Whittle Index Network For Restless Bandits Via Deep RL
2021 · 3 citations
Developing Multi-Task Recommendations with Long-Term Rewards via Policy Distilled Reinforcement Learning
2020 · 2 citations
Neural PPO-Clip Attains Global Optimality: A Hinge Loss Perspective
2021 · 2 citations
From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning
2026
A Reward-Free Viewpoint on Multi-Objective Reinforcement Learning
2026
Cross-Domain Policy Optimization via Bellman Consistency and Hybrid Critics
2026
Learning Human-Like RL Agents Through Trajectory Optimization With Action Quantization
2025
Q-Pensieve: Boosting Sample Efficiency of Multi-Objective RL Through Memory Sharing of Q-Snapshots
2022
Coordinate Ascent for Off-Policy RL with Global Convergence Guarantees
2022
Towards Human-Like RL: Taming Non-Naturalistic Behavior in Deep RL via Adaptive Behavioral Costs in 3D Games
2023
Value-Biased Maximum Likelihood Estimation for Model-based Reinforcement Learning in Discounted Linear MDPs
2023
Accelerated Policy Gradient: On the Convergence Rates of the Nesterov Momentum for Reinforcement Learning
2023
Top co-authors
Xi Liu
· 5
Li Li
· 1
Rui Chen
· 1
Shao-Hua Sun
· 1
Srinivas Shakkottai
· 1
Zhang-Wei Hong
· 1
Topics
Policy Gradient
Safe RL
cs.LG
Value-Based
Model-Based RL
Game AI
cs.AI
cs.RO
Multi-Agent
Offline RL