Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Philip S. Thomas — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Philip S. Thomas
25
papers ·
232
citations ·
22
h-index
Kutztown University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Data-Efficient Off-Policy Policy Evaluation for Reinforcement Learning
2016 · 74 citations
Policy Gradient Methods for Reinforcement Learning with Function Approximation and Action-Dependent Baselines
2017 · 45 citations
Using Options and Covariance Testing for Long Horizon Off-Policy Policy Evaluation
2017 · 25 citations
Learning Action Representations for Reinforcement Learning
2019 · 22 citations
Evaluating the Performance of Reinforcement Learning Algorithms
2020 · 19 citations
Optimizing for the Future in Non-Stationary MDPs
2020 · 12 citations
Data-Efficient Policy Evaluation Through Behavior Policy Search
2017 · 9 citations
Towards Safe Policy Improvement for Non-Stationary MDPs
2020 · 9 citations
Reinforcement learning with a network of spiking agents
2019 · 3 citations
Universal Off-Policy Evaluation
2021 · 3 citations
Off-Policy Evaluation for Action-Dependent Non-Stationary Environments
2023 · 3 citations
Privacy Preserving Off-Policy Evaluation
2019 · 2 citations
Reinforcement Learning for Strategic Recommendations
2020 · 2 citations
Behavior Alignment via Reward Function Optimization
2023 · 2 citations
Position: Benchmarking is Limited in Reinforcement Learning Research
2024 · 1 citations
Top co-authors
Yash Chandak
· 11
Bruno Castro da Silva
· 7
Georgios Theocharous
· 5
Emma Brunskill
· 4
Martha White
· 4
Scott M. Jordan
· 4
Scott Niekum
· 4
Dhawal Gupta
· 3
Chris Nota
· 2
James Kostas
· 2
Scott M. Jordan
· 2
Shreyas Chaudhari
· 2
Topics
Value-Based
Offline RL
Exploration
Policy Gradient
Model-Based RL
Safe RL
Meta-RL
RLHF & Alignment
Multi-Agent