Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiaoying Zhang — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Xiaoying Zhang
24
papers ·
41
citations ·
0
h-index
Universiti Putra Malaysia
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Overcoming Reward Overoptimization via Adversarial Policy Optimization with Lightweight Uncertainty Estimation
2024 · 1 citations
RetroAgent: From Solving to Evolving via Retrospective Dual Intrinsic Feedback
2026
Right Makes Might: Aligning Verified Hidden States Empowers RL Reasoning
2026
Step-wise Rubric Rewards for LLM Reasoning
2026
Leveraging Error Diversity in Group Rollouts for Reinforcement Learning
2026
Critique-GRPO: Advancing LLM Reasoning with Natural Language and Numerical Feedback
2025
Uncertainty-Aware Instance Reweighting for Off-Policy Learning
2023
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards
2024
Top co-authors
Wenqi Shao
· 4
Jiaqi Wang
· 3
Nan Duan
· 3
Shuai Dong
· 3
Wenpu Liu
· 3
Yang Liu
· 3
Yongfu Zhu
· 3
Yuqi Xu
· 3
Ziyue Wang
· 3
Hongning Wang
· 2
Wei Shen
· 2
Yipeng Zhang
· 2
Topics
Policy Gradient
cs.LG
RLHF & Alignment
Model-Based RL
Offline RL
cs.AI
Exploration