Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Scott Sanner — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Scott Sanner
25
papers ·
217
citations ·
40
h-index
University of Toronto · Vector Institute
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
ε-BMC: A Bayesian Ensemble Approach to Epsilon-Greedy Exploration in Model-Free Reinforcement Learning
2020 · 11 citations
Risk-Aware Transfer in Reinforcement Learning using Successor Features
2021 · 9 citations
Learning to Follow Instructions in Text-Based Games
2022 · 2 citations
Contextual Policy Transfer in Reinforcement Learning Domains via Deep Mixtures-of-Experts
2020 · 1 citations
Reflect-then-Plan: Offline Model-Based Planning through a Doubly Bayesian Lens
2025
Reward Potentials for Planning with Learned Neural Network Transition Models
2019
RAPTOR: End-to-end Risk-Aware MDP Planning and Policy Learning by Backpropagation
2021
Conservative Bayesian Model-Based Value Expansion for Offline Policy Optimization
2022
Perimeter Control Using Deep Reinforcement Learning: A Model-free Approach towards Homogeneous Flow Rate Optimization
2023
Constraint-Generation Policy Optimization (CGPO): Nonlinear Programming for Policy Optimization in Mixed Discrete-Continuous MDPs
2024
Generalized Multi-hop Traffic Pressure for Heterogeneous Traffic Perimeter Control
2024
Mitigating Partial Observability in Adaptive Traffic Signal Control with Transformers
2024
Multi-hop Upstream Anticipatory Traffic Signal Control with Deep Reinforcement Learning
2024
Top co-authors
Michael Gimelfarb
· 6
Baher Abdulhai
· 4
Ayal Taitler
· 3
Chi-Guhn Lee
· 3
Xiaocan Li
· 3
Xiaoyu Wang
· 3
Ilia Smirnov
· 2
Jihwan Jeong
· 2
Xiaoyu Wang
· 2
and Baher Abdulhai
· 1
Andr\'e Barreto
· 1
Andrew C. Li
· 1
Topics
Model-Based RL
Safe RL
Value-Based
Policy Gradient
Offline RL
Exploration
Meta-RL
Multi-Agent
Game AI
RLHF & Alignment