Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Bolin Ding — most-cited papers & profile · Large Language Models
← authors
·
overview
Bolin Ding
59
papers ·
872
citations ·
41
h-index
Alibaba Group (United States) · Alibaba Group (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
2025 · 68 citations
From Atomic Actions to Standard Operating Procedures: Iterative Tool Optimization for Self-Evolving LLM Agents
2026
SeeUPO: Sequence-Level Agentic-RL with Convergence Guarantees
2026
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
2026
On the Direction of RLVR Updates for LLM Reasoning: Identification and Exploitation
2026
RePO: ReLU-based Preference Optimization
2025
Trinity-RFT: A General-Purpose and Unified Framework for Reinforcement Fine-Tuning of Large Language Models
2025
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
2025
AgentScope 1.0: A Developer-Centric Framework for Building Agentic Applications
2025
Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends
2025
Larger or Smaller Reward Margins to Select Preferences for Alignment?
2025
RePO: Understanding Preference Learning Through ReLU-Based Optimization
2025
Federated Full-Parameter Tuning of Billion-Sized Language Models with Communication Cost under 18 Kilobytes
2023
Data Mixing Made Efficient: A Bivariate Scaling Law for Language Model Pretraining
2024
A Simple and Provable Scaling Law for the Test-Time Compute of Large Language Models
2024
Top co-authors
Yaliang Li
· 9
Jingren Zhou
· 7
Yanxi Chen
· 6
Kexin Huang
· 5
Xue Wang
· 5
Yuexiang Xie
· 5
Guoyin Wang
· 4
Jiancan Wu
· 4
Junkang Wu
· 4
Wenhao Zhang
· 4
Xiangnan He
· 4
Xiang Wang
· 4
Topics
Efficiency
Reinforcement Learning
Training Techniques
Fine-Tuning
Evaluation
Safety & Alignment
Agentic
In-Context Learning
off-policy
on-policy