Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yao Liu — most-cited papers & profile · AI for Code
← authors
·
overview
Yao Liu
38
papers ·
161
citations ·
0
h-index
Beijing University of Chemical Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Off-Policy Policy Gradient with State Distribution Correction
2019 · 46 citations
Provably Good Batch Reinforcement Learning Without Great Exploration
2020 · 36 citations
Generalized Federated Learning via Sharpness Aware Minimization
2022 · 20 citations
Combining Parametric and Nonparametric Models for Off-Policy Evaluation
2019 · 12 citations
Interpretable Off-Policy Evaluation in Reinforcement Learning by Highlighting Influential Transitions
2020 · 12 citations
Learning to Guide Human Attention on Mobile Telepresence Robots with 360 Vision
2021 · 9 citations
Understanding the Curse of Horizon in Off-Policy Evaluation via Conditional Importance Sampling
2019 · 8 citations
When Simple Exploration is Sample Efficient: Identifying Sufficient Conditions for Random Exploration to Yield PAC RL Algorithms
2018 · 6 citations
From Demonstrations to Rewards: Alignment Without Explicit Human Preferences
2025 · 4 citations
Reinforcement Learning Tutor Better Supported Lower Performers in a Math Task
2023 · 4 citations
DRKF: Decoupled Representations With Knowledge Fusion For Multimodal Emotion Recognition
2025 · 2 citations
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
2025 · 1 citations
Budgeting Counterfactual for Offline RL
2023 · 1 citations
HydraHead: From Head-Level Functional Heterogeneity to Specialized Attention Hybridization
2026
Adversarial Update-Based Federated Unlearning for Poisoned Model Recovery
2026
Top co-authors
Changjia Zhu
· 1
Chi Zhang
· 1
Junjie Xiong
· 1
Lingyao Li
· 1
Xiaoran Xu
· 1
Zhuo Lu
· 1
Topics
Offline RL
Value-Based
Model-Based RL
Policy Gradient
RLHF & Alignment
Training Techniques
Safe RL
Meta-RL
Efficiency
cs.LG