Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Guorui Zhou — most-cited papers & profile · Large Language Models
← authors
·
overview
Guorui Zhou
17
papers ·
314
citations ·
22
h-index
Kuaishou (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Agentic Reinforced Policy Optimization
2025 · 94 citations
Agentic Reinforced Policy Optimization
2025 · 94 citations
Multi-behavior Self-supervised Learning for Recommendation
2023 · 84 citations
Contextual Distillation Model for Diversified Recommendation
2024 · 24 citations
Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning
2025 · 15 citations
MISS: Multi-Modal Tree Indexing and Searching with Lifelong Sequential Behavior for Retrieval Recommendation
2025 · 3 citations
Why Distillation can Outperform Zero-RL: The Role of Flexible Reasoning
2025
Klear-AgentForge: Forging Agentic Intelligence through Posttraining Scaling
2025
Entropy Ratio Clipping as a Soft Global Constraint for Stable Reinforcement Learning
2025
Compressing then Matching: An Efficient Pre-training Paradigm for Multimodal Embedding
2025
LLM-Aligned Geographic Item Tokenization for Local-Life Recommendation
2025
Unlocking Exploration in RLVR: Uncertainty-aware Advantage Shaping for Deeper Reasoning
2025
OneRec-Think: In-Text Reasoning for Generative Recommendation
2025
Agentic Entropy-Balanced Policy Optimization
2025
CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning
2025
Topics
Policy Gradient
RLHF & Alignment
Multi-Agent
Model-Based RL
Exploration
LLM-based
Ranking & CTR
Benchmarks
Tool Use
Evaluation