Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yu-Xiang Wang — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Yu-Xiang Wang
36
papers ·
1194
citations ·
30
h-index
The University of Sydney
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Towards Optimal Off-Policy Evaluation for Reinforcement Learning with Marginalized Importance Sampling
2019 · 53 citations
Asymptotically Efficient Off-Policy Evaluation for Tabular Reinforcement Learning
2020 · 24 citations
Near-Optimal Provable Uniform Convergence in Offline Policy Evaluation for Reinforcement Learning
2020 · 24 citations
Optimal and Adaptive Off-policy Evaluation in Contextual Bandits
2016 · 20 citations
Near-Optimal Offline Reinforcement Learning via Double Variance Reduction
2021 · 18 citations
Imitation-Regularized Offline Learning
2019 · 5 citations
Towards Instance-Optimal Offline Reinforcement Learning with Pessimism
2021 · 4 citations
Sample-Efficient Reinforcement Learning with loglog(T) Switching Cost
2022 · 3 citations
Near-optimal Offline Reinforcement Learning with Linear Representation: Leveraging Variance Information with Pessimism
2022 · 3 citations
Offline Reinforcement Learning with Differential Privacy
2022 · 3 citations
NetworkGym: Reinforcement Learning Environments for Multi-Access Traffic Management in Network Simulation
2024 · 2 citations
Optimal Uniform OPE and Model-based Offline Reinforcement Learning in Time-Homogeneous, Reward-Free and Task-Agnostic Settings
2021 · 1 citations
Offline Reinforcement Learning with Closed-Form Policy Improvement Operators
2022 · 1 citations
Non-stationary Reinforcement Learning under General Function Approximation
2023 · 1 citations
On the Statistical Complexity for Offline and Low-Adaptive Reinforcement Learning with Structures
2025
Top co-authors
Ming Yin
· 14
Dan Qiao
· 8
Mengdi Wang
· 5
Jing Yang
· 2
Yu Bai
· 2
Alekh Agarwal
· 1
Edwin Zhang
· 1
Jiachen Li
· 1
Tengyang Xie
· 1
William Yang Wang
· 1
Xuan Wang
· 1
Yaqi Duan
· 1
Topics
Offline RL
Model-Based RL
Value-Based
Exploration
Multi-Agent
Policy Gradient
Safe RL
Game AI