Awesome Reinforcement Learning
๐
Papers
๐งญ
Topics
๐ฅ
Trending
๐บ๏ธ
Map
๐
Leaderboards
๐
Learn
๐ค
Ask AI
โฏ
More
๐ฅ
Authors
๐
Reading Packs
๐
Datasets
๐ ๏ธ
Tools
๐ฐ
News
๐
Blogs
โ๏ธ
Newsletter
๐ฏ
Research Radar
๐
Saved
+ Add Paper
โพ
โ
โ authors
ยท
overview
Loading authorโฆ
๐ค
Ask AI
Masatoshi Uehara โ most-cited papers & profile ยท Reinforcement Learning
โ authors
ยท
overview
Masatoshi Uehara
30
papers ยท
223
citations ยท
12
h-index
Chan Zuckerberg Initiative (United States) ยท Institut de Biologia Evolutiva
Google Scholar โ
Semantic Scholar โ
OpenAlex โ
Most-cited papers
Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes
2019 ยท 50 citations
Minimax Weight and Q-Function Learning for Off-Policy Evaluation
2019 ยท 29 citations
Intrinsically Efficient, Stable, and Bounded Off-Policy Evaluation for Reinforcement Learning
2019 ยท 23 citations
Finite Sample Analysis of Minimax Offline Reinforcement Learning: Completeness, Fast Rates and First-Order Efficiency
2021 ยท 14 citations
A Review of Off-Policy Evaluation in Reinforcement Learning
2022 ยท 13 citations
Off-Policy Evaluation and Learning for External Validity under a Covariate Shift
2020 ยท 8 citations
Pessimistic Model-based Offline Reinforcement Learning under Partial Coverage
2021 ยท 6 citations
Representation Learning for Online and Offline RL in Low-rank MDPs
2021 ยท 5 citations
Fast Rates for the Regret of Offline Reinforcement Learning
2021 ยท 4 citations
Statistically Efficient Off-Policy Policy Gradients
2020 ยท 3 citations
Doubly Robust Off-Policy Value and Gradient Estimation for Deterministic Policies
2020 ยท 3 citations
Provably Efficient Reinforcement Learning in Partially Observable Dynamical Systems
2022 ยท 3 citations
Efficiently Breaking the Curse of Horizon in Off-Policy Evaluation with Double Reinforcement Learning
2019 ยท 2 citations
Optimal Off-Policy Evaluation from Multiple Logging Policies
2020 ยท 2 citations
A Minimax Learning Approach to Off-Policy Evaluation in Confounded Partially Observable Markov Decision Processes
2021 ยท 2 citations
Top co-authors
Nathan Kallus
ยท 13
Wen Sun
ยท 7
Jason D. Lee
ยท 5
Wenhao Zhan
ยท 3
Ayush Sekhari
ยท 2
Chengchun Shi
ยท 2
Nan Jiang
ยท 2
Sergey Levine
ยท 2
Tommaso Biancalani
ยท 2
Wen Sun
ยท 2
Xuezhou Zhang
ยท 2
Alekh Agarwal
ยท 1
Topics
Offline RL
Value-Based
Model-Based RL
Exploration
Policy Gradient
RLHF & Alignment