Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Quanquan Gu — most-cited papers & profile · AI for Code
← authors
·
overview
Quanquan Gu
73
papers ·
320
citations ·
53
h-index
University of California, Los Angeles · Zhejiang Shuren University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
TrustLLM: Trustworthiness in Large Language Models
2024 · 53 citations
A Finite Time Analysis of Two Time-Scale Actor Critic Methods
2020 · 37 citations
Sample Efficient Policy Gradient Methods with Recursive Variance Reduction
2019 · 34 citations
An Improved Convergence Analysis of Stochastic Variance-Reduced Policy Gradient
2019 · 33 citations
Provably Efficient Reinforcement Learning for Discounted MDPs with Feature Mapping
2020 · 30 citations
Nearly Minimax Optimal Reinforcement Learning for Linear Mixture Markov Decision Processes
2020 · 23 citations
Logarithmic Regret for Reinforcement Learning with Linear Function Approximation
2020 · 21 citations
A Finite-Time Analysis of Q-Learning with Neural Network Function Approximation
2019 · 18 citations
Differentially Private Federated Learning with Laplacian Smoothing
2020 · 9 citations
Nearly Minimax Optimal Reinforcement Learning for Discounted MDPs
2020 · 9 citations
Reward-Free Model-Based Reinforcement Learning with Linear Function Approximation
2021 · 6 citations
Personalized Federated Learning under Mixture of Distributions
2023 · 6 citations
Mitigating Object Hallucination In Large Vision-language Models Via Image-grounded Guidance
2024 · 4 citations
Nearly Minimax Optimal Regret for Learning Infinite-horizon Average-reward MDPs with Linear Function Approximation
2021 · 4 citations
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
2021 · 4 citations
Top co-authors
Mengdi Wang
· 2
Yifan Zhang
· 2
Jiacheng Guo
· 1
Shuzhen Li
· 1
Yifeng Liu
· 1
Topics
Model-Based RL
Exploration
Value-Based
Offline RL
Policy Gradient
Reinforcement Learning
Training Techniques
Evaluation
Safety & Alignment
RLHF & Alignment