Awesome AI for Science
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Rui Zheng — most-cited papers & profile · AI for Science
← authors
·
overview
Rui Zheng
16
papers ·
44
citations ·
0
h-index
Qingdao University of Technology · University of Science and Technology Beijing
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Improving RL Exploration for LLM Reasoning through Retrospective Replay
2025 · 19 citations
Toward Optimal LLM Alignments Using Two-player Games
2024 · 13 citations
Uncertainty Aware Learning For Language Model Alignment
2024 · 11 citations
RedAgent: An Autonomous Agent for Context-Aware Red Teaming of LLM Jailbreaks
2026 · 1 citations
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
2025
What Makes a Good Speech Tokenizer for LLM-Centric Speech Generation? A Systematic Study
2025
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
2025
BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping
2025
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
2025
Nex-N1: Agentic Models Trained via a Unified Ecosystem for Large-Scale Environment Construction
2025
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards
2024
RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent
2024
RMB: Comprehensively Benchmarking Reward Models in LLM Alignment
2024
Secrets of RLHF in Large Language Models Part I: PPO
2023
Secrets of RLHF in Large Language Models Part II: Reward Modeling
2024
Topics
Reinforcement Learning
Training Techniques
Safety & Alignment
RAG
Fine-Tuning
cs.CL
Efficiency
cs.AI
In-Context Learning
Evaluation