Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
RLHF
loadingβ¦
π€
Ask AI
Awesome RLHF β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
RLHF
10 papers tagged RLHF β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
10 papers Β· trending (default)
numbers = π₯ heat
PILAF: Optimal Human Preference Sampling for Reward Modeling
(2025)
Yunzhen Feng et al.
1.28
DRAGON: Distributional Rewards Optimize Diffusion Generative Models
(2025)
Yatong Bai et al.
1.28
RewardDance: Reward Scaling in Visual Generation
(2025)
Jie Wu et al.
1.28
On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes
(2023)
Rishabh Agarwal et al.
β
Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback
(2023)
Stephen Casper et al.
β
Efficient RLHF: Reducing the Memory Usage of PPO
(2023)
Michael Santacroce et al.
β
ICE-GRT: Instruction Context Enhancement by Generative Reinforcement based Transformers
(2024)
Chen Zheng et al.
β
RewardBench: Evaluating Reward Models for Language Modeling
(2024)
Nathan Lambert et al.
β
Measuring memorization in RLHF for code completion
(2024)
Aneesh Pappu et al.
β
Model Surgery: Modulating LLM's Behavior Via Simple Parameter Editing
(2024)
Huanqian Wang et al.
β