Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Bruno Castro da Silva — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Bruno Castro da Silva
13
papers ·
25
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs
2024 · 10 citations
Optimal Options for Multi-Task Reinforcement Learning Under Time Constraints
2020 · 3 citations
Universal Off-Policy Evaluation
2021 · 3 citations
Model-Based Reinforcement Learning with SINDy
2022 · 3 citations
Off-Policy Evaluation for Action-Dependent Non-Stationary Environments
2023 · 3 citations
Behavior Alignment via Reward Function Optimization
2023 · 2 citations
Position: Benchmarking is Limited in Reinforcement Learning Research
2024 · 1 citations
Abstract Reward Processes: Leveraging State Abstraction for Consistent Off-Policy Evaluation
2024 · 1 citations
Enabling Option Learning in Sparse Rewards with Hindsight Experience Replay
2026
AltNet: Addressing the Plasticity-Stability Dilemma in Reinforcement Learning
2025
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
2025
Autonomous learning of multiple, context-dependent tasks
2020
Coagent Networks: Generalized and Scaled
2023
Top co-authors
Philip S. Thomas
· 7
Yash Chandak
· 4
Scott M. Jordan
· 3
Shreyas Chaudhari
· 3
Ameet Deshpande
· 2
Dhawal Gupta
· 2
Gianluca Baldassarre
· 2
Martha White
· 2
Adam White
· 1
Ashwin Kalyan
· 1
Davide Montella
· 1
Eliot Moss
· 1
Topics
Exploration
Meta-RL
cs.AI
cs.LG
Offline RL
Model-Based RL
Multi-Agent
Value-Based
Policy Gradient
RLHF & Alignment