Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
Feedback
loadingβ¦
π€
Ask AI
Awesome Feedback β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
Feedback
15 papers tagged Feedback β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
15 papers Β· trending (default)
numbers = π₯ heat
RLHS: Mitigating Misalignment in RLHF with Hindsight Simulation
(2025)
Kaiqu Liang et al.
1.28
PlotGen: Multi-Agent LLM-based Scientific Data Visualization via Multimodal Feedback
(2025)
Kanika Goswami et al.
1.28
PILAF: Optimal Human Preference Sampling for Reward Modeling
(2025)
Yunzhen Feng et al.
1.28
Iterative Value Function Optimization for Guided Decoding
(2025)
Zhenhua Liu et al.
1.28
Dedicated Feedback and Edit Models Empower Inference-Time Scaling for Open-Ended General-Domain Tasks
(2025)
Zhilin Wang et al.
1.28
Accelerating Nash Learning from Human Feedback via Mirror Prox
(2025)
Daniil Tiapkin et al.
1.28
RLBFF: Binary Flexible Feedback to bridge between Human Feedback & Verifiable Rewards
(2025)
Zhilin Wang et al.
1.28
Latent Refinement Decoding: Enhancing Diffusion-Based Language Models by Refining Belief States
(2025)
Qinglin Zhu et al.
1.28
PokeeResearch: Effective Deep Research via Reinforcement Learning from AI Feedback and Robust Reasoning Scaffold
(2025)
Yi Wan et al.
1.28
Efficient RLHF: Reducing the Memory Usage of PPO
(2023)
Michael Santacroce et al.
β
ICE-GRT: Instruction Context Enhancement by Generative Reinforcement based Transformers
(2024)
Chen Zheng et al.
β
MusicRL: Aligning Music Generation to Human Preferences
(2024)
Geoffrey Cideron et al.
β
NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment
(2024)
Gerald Shen et al.
β
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
(2024)
Guanting Dong et al.
β
Model Surgery: Modulating LLM's Behavior Via Simple Parameter Editing
(2024)
Huanqian Wang et al.
β