Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Chenjun Xiao — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Chenjun Xiao
20
papers ·
52
citations ·
8
h-index
Chinese University of Hong Kong, Shenzhen
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Learning to Combat Compounding-Error in Model-Based Reinforcement Learning
2019 · 16 citations
Kimi k1.5: Scaling Reinforcement Learning with LLMs
2025 · 11 citations
Rethinking Decision Transformer via Hierarchical Reinforcement Learning
2023 · 4 citations
The In-Sample Softmax for Offline Reinforcement Learning
2023 · 3 citations
On the Optimality of Batch Policy Optimization Algorithms
2021 · 2 citations
The Curse Of Passive Data Collection In Batch Reinforcement Learning
2021 · 1 citations
Latent Variable Representation for Reinforcement Learning
2022 · 1 citations
Conditionally Optimistic Exploration for Cooperative Deep Multi-Agent Reinforcement Learning
2023 · 1 citations
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
2023 · 1 citations
Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning
2025
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
2025
$e̱ta$-DQN: Improving Deep Q-Learning By Evolving the Behavior
2025
Understanding the Effect of Stochasticity in Policy Optimization
2021
Provable Representation with Efficient Planning for Partial Observable Reinforcement Learning
2023
An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models
2024
Top co-authors
Dale Schuurmans
· 7
Bo Dai
· 3
Chen-Xiao Gao
· 3
Csaba Szepesvari
· 3
Jincheng Mei
· 3
Yangchen Pan
· 3
Flood Sung
· 2
Han Zhu
· 2
Hongming Zhang
· 2
Longhui Yu
· 2
Tongzheng Ren
· 2
Yangyang Hu
· 2
Topics
Model-Based RL
Offline RL
Exploration
Value-Based
Policy Gradient
RLHF & Alignment
Safe RL
Meta-RL
Multi-Agent