Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Pengfei Li — most-cited papers & profile · AI for Code
← authors
·
overview
Pengfei Li
34
papers ·
135
citations ·
26
h-index
Zhaotong University · Nanjing Hydraulic Research Institute · Yunnan Archaeology · Tsinghua University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Online DPO: Online Direct Preference Optimization With Fast-slow Chasing
2024 · 38 citations
Qualitative Measurements of Policy Discrepancy for Return-Based Deep Q-Network
2018 · 22 citations
A Robust Adversary Detection-deactivation Method For Metaverse-oriented Collaborative Deep Learning
2023 · 20 citations
Constrained Update Projection Approach to Safe Policy Optimization
2022 · 19 citations
Self-supervised vision-language pretraining for Medical visual question answering
2022 · 10 citations
CUP: A Conservative Update Policy Algorithm for Safe Reinforcement Learning
2022 · 7 citations
PlanAgent: A Multi-modal Large Language Agent for Closed-loop Vehicle Motion Planning
2024 · 5 citations
PlanAgent: A Multi-modal Large Language Agent for Closed-loop Vehicle Motion Planning
2026 · 4 citations
ChatMusician: Understanding and Generating Music Intrinsically with LLM
2024 · 4 citations
A Survey of Reinforcement Learning for Large Reasoning Models
2025 · 2 citations
Policy Optimization with Stochastic Mirror Descent
2019 · 2 citations
Multi-person 3D Pose Estimation in Crowded Scenes Based on Multi-View Geometry
2020 · 2 citations
Unveiling the Surprising Efficacy of Navigation Understanding in End-to-End Autonomous Driving
2026
MARS$^2$: Scaling Multi-Agent Tree Search via Reinforcement Learning for Code Generation
2026
PokeVLA: Empowering Pocket-Sized Vision-Language-Action Model with Comprehensive World Knowledge Guidance
2026
Topics
Control
Perception
Manipulation
Human-Robot Interaction
Policy Gradient
Training Techniques
Value-Based
Reinforcement Learning
cs.AI
cs.LG