Awesome Recommender Systems
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Changlong Yu — most-cited papers & profile · Recommender Systems
← authors
·
overview
Changlong Yu
13
papers ·
21
citations ·
9
h-index
Amazon (United States) · Amazon (Germany)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
2025 · 1 citations
Process Reward Informed Tree Rollout for Effective Multi-Turn RL
2026
Beyond Test-Time Training: Learning to Reason via Hardware-Efficient Optimal Control
2026
Rethinking Importance Sampling in LLM Policy Optimization: A Cumulative Token Perspective
2026
Approximation of Log-Partition Function in Policy Mirror Descent Induces Implicit Regularization for LLM Post-Training
2026
HeaPA: Difficulty-Aware Heap Sampling and On-Policy Query Augmentation for LLM Reinforcement Learning
2026
Learning to Optimize Multi-Objective Alignment Through Dynamic Reward Weighting
2025
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
2025
Think-RM: Enabling Long-Horizon Reasoning in Generative Reward Models
2025
Think-RM: Enabling Long-Horizon Reasoning in Generative Reward Models
2025
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
2025
Topics
cs.LG
Reinforcement Learning
Multi-Agent
Training Techniques
RAG
cs.CL
Model-Based RL
RLHF & Alignment
Planning
Evaluation