Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yunpu Ma — most-cited papers & profile · AI for Code
← authors
·
overview
Yunpu Ma
26
papers ·
246
citations ·
19
h-index
Munich Center for Quantum Science and Technology · Ludwig-Maximilians-Universität München
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
2025 · 98 citations
Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
2025 · 98 citations
Webpilot: A Versatile And Autonomous Multi-agent System For Web Task Execution With Strategic Exploration
2024 · 10 citations
3D-RETR: End-to-End Single and Multi-View 3D Reconstruction with Transformers
2021 · 9 citations
WebPilot: A Versatile and Autonomous Multi-Agent System for Web Task Execution with Strategic Exploration
2024 · 4 citations
Improving Few-Shot Inductive Learning on Temporal Knowledge Graphs using Confidence-Augmented Reinforcement Learning
2023 · 3 citations
OpenDriveVLA: Towards End-to-end Autonomous Driving with Large Vision Language Action Model
2025 · 1 citations
TimeTraveler: Reinforcement Learning for Temporal Knowledge Graph Forecasting
2021 · 1 citations
EchoRL: Reinforcement Learning via Rollout Echoing
2026
Agentic Neural Networks: Self-Evolving Multi-Agent Systems via Textual Backpropagation
2025
Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents
2026
Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents
2026
On-Policy Supervised Fine-Tuning for Efficient Reasoning
2026
Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers
2025
Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers
2025
Topics
Multi-Agent
Model-Based RL
Reinforcement Learning
Fine-Tuning
Evaluation
Policy Gradient
Training Techniques
Exploration
Agentic
RLHF & Alignment