Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yihe Deng — most-cited papers & profile · Large Language Models
← authors
·
overview
Yihe Deng
13
papers ·
9
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DuoGuard: A Two-Player RL-Driven Framework for Multilingual LLM Guardrails
2025
OpenVLThinker: An Early Exploration to Complex Vision-Language Reasoning via Iterative Self-Improvement
2025
Entropy-Based Adaptive Weighting for Self-Training
2025
Supervised Reinforcement Learning: From Expert Trajectories to Step-wise Reasoning
2025
Enhancing LLM Safety Through a Theoretical Minimax Game Lens
2025
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
2024
MIRAI: Evaluating LLM Agents for Event Forecasting
2024
Flow-DPO: Improving LLM Mathematical Reasoning through Online Multi-Agent Learning
2024
Top co-authors
Wei Wang
· 6
Mingyu Derek Ma
· 2
Yu Yang
· 2
Bo Li
· 1
Bo Li
· 1
Chenchen Ye
· 1
Chen-Yu Lee
· 1
Fan Yin
· 1
Gufeng Zhang
· 1
Hritik Bansal
· 1
Huizhuo Yuan
· 1
I-Hung Hsu
· 1
Topics
Fine-Tuning
Reinforcement Learning
Training Techniques
Supervised
Safety & Alignment
Efficiency
RAG
Evaluation
Reinforcement
Learning