Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Rui Zheng — most-cited papers & profile · Large Language Models
← authors
·
overview
Rui Zheng
37
papers ·
90
citations ·
0
h-index
Qingdao University of Technology · University of Science and Technology Beijing
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Toward Optimal LLM Alignments Using Two-player Games
2024 · 13 citations
Uncertainty Aware Learning For Language Model Alignment
2024 · 11 citations
Rescue: Ranking LLM Responses With Partial Ordering To Improve Response Generation
2023 · 6 citations
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
2025
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
2025
BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping
2025
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
2025
Nex-N1: Agentic Models Trained via a Unified Ecosystem for Large-Scale Environment Construction
2025
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards
2024
RMB: Comprehensively Benchmarking Reward Models in LLM Alignment
2024
Secrets of RLHF in Large Language Models Part I: PPO
2023
Secrets of RLHF in Large Language Models Part II: Reward Modeling
2024
StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback
2024
AgentGym: Evolving Large Language Model-based Agents across Diverse Environments
2024
Top co-authors
Qi Zhang
· 10
Tao Gui
· 10
Xuanjing Huang
· 10
Zhiheng Xi
· 10
Enyu Zhou
· 5
Wei Shen
· 5
Hang Yan
· 4
Honglin Guo
· 4
Jixuan Huang
· 4
Lu Chen
· 4
Shihan Dou
· 4
Xiaoran Fan
· 4
Topics
Reinforcement Learning
Training Techniques
Safety & Alignment
Evaluation
RAG
Fine-Tuning
In-Context Learning
Code
Efficiency
Vision-Language