Awesome Reinforcement Learning
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Yeyun Gong β most-cited papers & profile Β· Reinforcement Learning
β authors
Β·
overview
Yeyun Gong
18
papers Β·
57
citations Β·
28
h-index
Microsoft Research Asia (China)
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
2023 Β· 57 citations
MSign: An Optimizer Preventing Training Instability in Large Language Models via Stable Rank Restoration
2026
Training LLMs for Divide-and-Conquer Reasoning Elevates Test-Time Scalability
2026
Improving Data and Reward Design for Scientific Reasoning in Large Language Models
2026
Beyond Length: Quantifying Long-Range Information for Long-Context LLM Pretraining Data
2025
Sigma: Differential Rescaling of Query, Key and Value for Efficient Language Models
2025
Optimizing Large Language Model Training Using FP4 Quantization
2025
Process-based Self-Rewarding Language Models
2025
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
2025
How does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
2025
TL;DR: Too Long, Do Re-weighting for Effcient LLM Reasoning Compression
2025
SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning
2025
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
2025
Beyond Pass@1: Self-Play with Variational Problem Synthesis Sustains RLVR
2025
Recycling Pretrained Checkpoints: Orthogonal Growth of Mixture-of-Experts for Efficient Large Language Model Pre-Training
2025
Topics
Training Techniques
Efficiency
Reinforcement Learning
Model Architecture
RAG
Evaluation
Fine-Tuning
In-Context Learning
Vision-Language
Code