Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Wei Xiong — most-cited papers & profile · Large Language Models
← authors
·
overview
Wei Xiong
34
papers ·
413
citations ·
14
h-index
Changsha University of Science and Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Interpretable Preferences Via Multi-objective Reward Modeling And Mixture-of-experts
2024 · 355 citations
Self-rewarding correction for mathematical reasoning
2025
A Minimalist Approach to LLM Reasoning: from Rejection Sampling to Reinforce
2025
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
2025
Reinforce-Ada: An Adaptive Sampling Framework for Reinforce-Style LLM Training
2025
RLHF Workflow: From Reward Modeling to Online RLHF
2024
Building Math Agents with Multi-Turn Iterative Preference Learning
2024
Top co-authors
Tong Zhang
· 6
Nan Jiang
· 5
Hanze Dong
· 4
Bo Pang
· 2
Caiming Xiong
· 2
Chenlu Ye
· 2
Doyen Sahoo
· 2
Hanning Zhang
· 2
Haoxiang Wang
· 2
Jiarui Yao
· 2
Aviv Rosenberg
· 1
Baohao Liao
· 1
Topics
Reinforcement Learning
Training Techniques
Fine-Tuning
Efficiency
Safety & Alignment
Evaluation
Code
large
language
models