Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yingbin Liang — most-cited papers & profile · AI for Code
← authors
·
overview
Yingbin Liang
42
papers ·
252
citations ·
37
h-index
Indiana University Indianapolis · The Ohio State University · Indiana University – Purdue University Indianapolis
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Finite-Sample Analysis for SARSA with Linear Function Approximation
2019 · 65 citations
Non-asymptotic Convergence Analysis of Two Time-scale (Natural) Actor-Critic Algorithms
2020 · 34 citations
Dynamic Fraud Detection: Integrating Reinforcement Learning into Graph Neural Networks
2024 · 24 citations
Improving Sample Complexity Bounds for (Natural) Actor-Critic Algorithms
2020 · 23 citations
Reanalysis of Variance Reduced Temporal Difference Learning
2020 · 18 citations
Finite-Time Analysis for Double Q-learning
2020 · 16 citations
CRPO: A New Approach for Safe Reinforcement Learning with Convergence Guarantee
2020 · 16 citations
Non-asymptotic Convergence of Adam-type Reinforcement Learning Algorithms under Markovian Sampling
2020 · 11 citations
Doubly Robust Off-Policy Actor-Critic: Convergence and Optimality
2021 · 8 citations
MR-GAN: Manifold Regularized Generative Adversarial Networks
2018 · 6 citations
Sample Complexity Bounds for Two Timescale Value-based Reinforcement Learning Algorithms
2020 · 5 citations
History-Gradient Aided Batch Size Adaptation for Variance Reduced Algorithms
2019 · 4 citations
Model-Based Offline Meta-Reinforcement Learning with Regularization
2022 · 4 citations
Distributed SGD Generalizes Well Under Asynchrony
2019 · 3 citations
When Will Generative Adversarial Imitation Learning Algorithms Attain Global Convergence
2020 · 3 citations
Topics
Model-Based RL
Value-Based
Policy Gradient
Offline RL
Safe RL
cs.LG
Exploration
Multi-Agent
cs.AI
Meta-RL