Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Nan Du — most-cited papers & profile · AI for Code
← authors
·
overview
Nan Du
21
papers ·
834
citations ·
32
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
ReAct: Synergizing Reasoning and Acting in Language Models
2022 · 563 citations
Learning Temporal Point Processes via Reinforcement Learning
2018 · 54 citations
Mixture-of-Experts Meets Instruction Tuning:A Winning Combination for Large Language Models
2023 · 20 citations
Massively Multilingual Shallow Fusion with Large Language Models
2023 · 14 citations
Review of security techniques for memristor computing systems
2022 · 9 citations
Variational hybridization and transformation for large inaccurate noisy-or networks
2016 · 2 citations
DoReMi: Optimizing Data Mixtures Speeds Up Language Model Pretraining
2023 · 1 citations
Context-Fidelity Boosting: Enhancing Faithful Generation through Watermark-Inspired Decoding
2026
DSL-R1: From SQL to DSL for Training Retrieval Agents across Structured and Unstructured Data with Reinforcement Learning
2026
S^2R: Teaching LLMs to Self-verify and Self-correct via Reinforcement Learning
2025
S$^2$R: Teaching LLMs to Self-verify and Self-correct via Reinforcement Learning
2025
Knowledge Graph Reasoning with Self-supervised Reinforcement Learning
2024
TDPP: Two-Dimensional Permutation-Based Protection of Memristive Deep Neural Networks
2023
Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game
2023
PaLM 2 Technical Report
2023
Topics
Efficiency
Training Techniques
Fine-Tuning
Model-Based RL
Policy Gradient
Model Architecture
Evaluation
Reinforcement Learning
In-Context Learning
RLHF & Alignment