Awesome AI Agents
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Shengyi Huang — most-cited papers & profile · AI Agents
← authors
·
overview
Shengyi Huang
4
papers ·
480
citations ·
14
h-index
Interface (United States) · Guilin University of Technology · Jiangsu University of Science and Technology · Chinese Academy of Forestry
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
A Closer Look at Invalid Action Masking in Policy Gradient Algorithms
2020 · 480 citations
A2C is a special case of PPO
2022
Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models
2024
TÜLU 3: Pushing Frontiers in Open Language Model Post-Training
2024
Topics
Policy Gradient
Game AI
Training Techniques
Safe RL
Reinforcement Learning
Efficiency
Code
Vision-Language
Fine-Tuning
Evaluation