Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Dong Yu — most-cited papers & profile · Large Language Models
← authors
·
overview
Dong Yu
178
papers ·
1268
citations ·
84
h-index
Seattle University · KLA (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MM-LLMs: Recent Advances in MultiModal Large Language Models
2024 · 16 citations
One Token to Fool LLM-as-a-Judge
2025 · 1 citations
FlashMemory-DeepSeek-V4: Lightning Index Ultra-Long Context via Lookahead Sparse Attention
2026
Group Distributionally Robust Optimization-Driven Reinforcement Learning for LLM Reasoning
2026
Locas: Your Models are Principled Initializers of Locally-Supported Parametric Memories
2026
CLUE: Non-parametric Verification from Experience via Hidden-State Clustering
2025
Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs
2025
Expanding RL with Verifiable Rewards Across Diverse Domains
2025
DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning
2025
MPS-Prover: Advancing Stepwise Theorem Proving by Multi-Perspective Search and Data Curation
2025
Two Experts Are All You Need for Steering Thinking: Reinforcing Cognitive Effort in MoE Reasoning Models Without Additional Training
2025
DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning
2025
Towards Solving More Challenging IMO Problems via Decoupled Reasoning and Proving
2025
R-Zero: Self-Evolving Reasoning LLM from Zero Data
2025
Parallel-R1: Towards Parallel Thinking via Reinforcement Learning
2025
Top co-authors
Haitao Mi
· 28
Linfeng Song
· 18
Dian Yu
· 16
Zhenwen Liang
· 12
Wenhao Yu
· 10
Zhaopeng Tu
· 8
Jiahao Xu
· 7
Tian Liang
· 6
Hongming Zhang
· 5
Kishan Panaganti
· 5
Qiuzhi Liu
· 5
Zhiwei He
· 5
Topics
Training Techniques
Efficiency
Reinforcement Learning
Evaluation
Model Architecture
Fine-Tuning
In-Context Learning
RAG
Safety & Alignment
Vision-Language