Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Guangming Sheng — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Guangming Sheng
5
papers ·
1767
citations ·
4
h-index
Hefei University of Technology · Hong Kong University of Science and Technology · University of Hong Kong
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DAPO: An Open-Source LLM Reinforcement Learning System at Scale
2025 · 1767 citations
Laminar: A Scalable Asynchronous RL Post-Training Framework
2025
HybridFlow: A Flexible and Efficient RLHF Framework
2024
Top co-authors
Chi Zhang
· 3
Haibin Lin
· 3
Wang Zhang
· 3
Chuan Wu
· 2
Xibin Wu
· 2
Xin Liu
· 2
Yanghua Peng
· 2
Yuxuan Tong
· 2
Bole Ma
· 1
Borui Wan
· 1
Chaobo Jia
· 1
Chengyi Wang
· 1
Topics
RLHF & Alignment
Policy Gradient
Value-Based
Model-Based RL