Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yu-Xiang Wang — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Yu-Xiang Wang
16
papers ·
1166
citations ·
30
h-index
The University of Sydney
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Towards Optimal Off-Policy Evaluation for Reinforcement Learning with Marginalized Importance Sampling
2019 · 53 citations
Asymptotically Efficient Off-Policy Evaluation for Tabular Reinforcement Learning
2020 · 24 citations
Near-Optimal Provable Uniform Convergence in Offline Policy Evaluation for Reinforcement Learning
2020 · 24 citations
Optimal and Adaptive Off-policy Evaluation in Contextual Bandits
2016 · 20 citations
Near-Optimal Offline Reinforcement Learning via Double Variance Reduction
2021 · 18 citations
Imitation-Regularized Offline Learning
2019 · 5 citations
Towards Instance-Optimal Offline Reinforcement Learning with Pessimism
2021 · 4 citations
Sample-Efficient Reinforcement Learning with loglog(T) Switching Cost
2022 · 3 citations
Optimal Uniform OPE and Model-based Offline Reinforcement Learning in Time-Homogeneous, Reward-Free and Task-Agnostic Settings
2021 · 1 citations
Offline Stochastic Shortest Path: Learning, Evaluation and Towards Optimality
2022
Near-Optimal Deployment Efficiency in Reward-Free Reinforcement Learning with Linear Function Approximation
2022
Logarithmic Switching Cost in Reinforcement Learning beyond Linear MDPs
2023
Posterior Sampling with Delayed Feedback for Reinforcement Learning with Linear Function Approximation
2023
Top co-authors
Ming Yin
· 4
Minghao Yin
· 3
Dan Qiao
· 2
Mengdi Wang
· 2
Ming Yin
· 2
Yifei Ma
· 2
Alekh Agarwal
· 1
Balakrishnan
· 1
Dan Qiao
· 1
Ming Min
· 1
Miroslav Dudı́k
· 1
Narayanaswamy
· 1
Topics
Offline RL
Model-Based RL
Value-Based
Exploration
Policy Gradient
Safe RL