Awesome AI Agents
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jiantao Jiao — most-cited papers & profile · AI Agents
← authors
·
overview
Jiantao Jiao
25
papers ·
84
citations ·
0
h-index
Nvidia (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Securing Secure Aggregation: Mitigating Multi-Round Privacy Leakage in Federated Learning
2021 · 19 citations
Jump-Start Reinforcement Learning
2022 · 17 citations
Principled Reinforcement Learning with Human Feedback from Pairwise or $K$-wise Comparisons
2023 · 16 citations
MADE: Exploration via Maximizing Deviation from Explored Regions
2021 · 11 citations
Fine-Tuning Language Models with Advantage-Induced Policy Alignment
2023 · 5 citations
Linear Representation Meta-Reinforcement Learning for Instant Adaptation
2021 · 4 citations
Pairwise Proximal Policy Optimization: Harnessing Relative Feedback for LLM Alignment
2023 · 4 citations
Deconstructing Generative Adversarial Networks
2019 · 2 citations
Bridging Offline Reinforcement Learning and Imitation Learning: A Tale of Pessimism
2021 · 2 citations
Robust Estimation for Nonparametric Families via Generative Adversarial Networks
2022 · 2 citations
Byzantine-Robust Federated Learning with Optimal Statistical Rates and Privacy Guarantees
2022 · 1 citations
Importance Weighted Actor-Critic for Optimal Conservative Offline Reinforcement Learning
2023 · 1 citations
DiscoLoop: Looping Discrete Embeddings and Continuous Hidden States for Multi-hop Reasoning
2026
dUltra: Ultra-Fast Diffusion Language Models via Reinforcement Learning
2025
Computational Benefits of Intermediate Rewards for Goal-Reaching Policy Learning
2021
Top co-authors
Ameet Talwalkar
· 1
Baihe Huang
· 1
Bohan Lyu
· 1
Chengshuai Shi
· 1
Chi Jin
· 1
Dapeng Jiang
· 1
Dawn Song
· 1
Huan-ang Gao
· 1
Huaqing Zhang
· 1
Jiaru Zhang
· 1
Junlin Yang
· 1
Kaicheng Yang
· 1
Topics
Model-Based RL
RLHF & Alignment
Offline RL
Policy Gradient
Exploration
Value-Based
cs.LG
cs.CL
GANs
Meta-RL