Awesome AI for Science
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Linfeng Song — most-cited papers & profile · AI for Science
← authors
·
overview
Linfeng Song
16
papers ·
164
citations ·
4
h-index
Guangxi Medical University · First People’s Hospital of Zunyi · First Affiliated Hospital of GuangXi Medical University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Toward Self-improvement Of Llms Via Imagination, Searching, And Criticizing
2024 · 138 citations
CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
2025 · 26 citations
SAGE-Music: Low-Latency Symbolic Music Generation via Attribute-Specialized Key-Value Head Sharing
2025
Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs
2025
DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning
2025
DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning
2025
CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
2025
Evolving Language Models without Labels: Majority Drives Selection, Novelty Promotes Variation
2025
CLUE: Non-parametric Verification from Experience via Hidden-State Clustering
2025
Every Question Has Its Own Value: Reinforcement Learning with Explicit Human Values
2025
Tree based Progressive Regression Model for Watch-Time Prediction in Short-video Recommendation
2023
Teaching LLMs to Refine with Tools
2024
Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing
2024
Iterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning
2024
Towards Self-Improvement of LLMs via MCTS: Leveraging Stepwise Knowledge with Curriculum Preference Learning
2024
Topics
Training Techniques
Reinforcement Learning
In-Context Learning
Fine-Tuning
Efficiency
Evaluation
Safety & Alignment
Prompting
RAG
Model Architecture