Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Ying Nian Wu — most-cited papers & profile · Large Language Models
← authors
·
overview
Ying Nian Wu
36
papers ·
154
citations ·
0
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Seek in the Dark: Reasoning via Test-Time Instance-Level Policy Gradient in Latent Space
2025 · 26 citations
Training LLMs for Divide-and-Conquer Reasoning Elevates Test-Time Scalability
2026
Seek in the Dark: Reasoning via Test-Time Instance-Level Policy Gradient in Latent Space
2025
TL;DR: Too Long, Do Re-weighting for Effcient LLM Reasoning Compression
2025
SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning
2025
Beyond Pass@1: Self-Play with Variational Problem Synthesis Sustains RLVR
2025
Top co-authors
Xiao Liang
· 4
Yeyun Gong
· 4
Weizhu Chen
· 3
Yelong Shen
· 3
Zhong-Zhi Li
· 3
Chenxi Li
· 2
Eric Hanchen Jiang
· 2
Hengli Li
· 2
Hengyuan Zhang
· 2
Song-Chun Zhu
· 2
Tong Wu
· 2
Xuekai Zhu
· 2
Topics
Reinforcement Learning
Training Techniques
Efficiency
RAG
cs.LG
cs.AI
cs.CL