Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yufei Zhang — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Yufei Zhang
35
papers ·
39
citations ·
17
h-index
Imperial College London
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Logarithmic regret for episodic continuous-time linear-quadratic reinforcement learning over a finite-time horizon
2020 · 12 citations
Regularity and stability of feedback relaxed controls
2020 · 5 citations
Exploration-exploitation trade-off for continuous-time episodic reinforcement learning with linear-convex models
2021 · 4 citations
Reinforcement learning for linear-convex models with jumps via stability analysis of feedback controls
2021 · 3 citations
Optimal scheduling of entropy regulariser for continuous-time linear-quadratic reinforcement learning
2022 · 3 citations
Insurance pricing on price comparison websites via reinforcement learning
2023 · 2 citations
A note on convergence of Wasserstein policy optimization
2026
DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning
2026
DORA: A Scalable Asynchronous Reinforcement Learning System for Language Model Training
2026
LongCat-Flash-Thinking-2601 Technical Report
2026
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
2025
Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games
2025
Efficient Learning for Entropy-Regularized Markov Decision Processes via Multilevel Monte Carlo
2025
Linear convergence of a policy gradient method for some finite horizon continuous time control problems
2022
$ε$-Policy Gradient for Online Pricing
2024
Top co-authors
Xin Guo
· 3
Chao Zhang
· 2
Hongyu Zang
· 2
Qi Gu
· 2
Tao Liang
· 2
Tianhao Hu
· 2
Wei Wang
· 2
Wenjie Shi
· 2
Xunliang Cai
· 2
Youshao Xiao
· 2
Yueqing Sun
· 2
Bei Li
· 1
Topics
Model-Based RL
Value-Based
Policy Gradient
Exploration
cs.LG
cs.AI
math.OC
Safe RL
cs.DC
stat.ML