Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Volker Tresp — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Volker Tresp
48
papers ·
400
citations ·
58
h-index
Siemens (Germany) · Munich Center for Quantum Science and Technology · Ludwig-Maximilians-Universität München
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
2025 · 98 citations
Maximum Entropy-Regularized Multi-Goal Reinforcement Learning
2019 · 47 citations
Curiosity-Driven Experience Prioritization via Density Estimation
2019 · 42 citations
Energy-Based Hindsight Experience Prioritization
2018 · 27 citations
Learning Goal-Oriented Visual Dialog via Tempered Policy Gradient
2018 · 14 citations
Efficient Dialog Policy Learning via Positive Memory Retention
2018 · 10 citations
WebPilot: A Versatile and Autonomous Multi-Agent System for Web Task Execution with Strategic Exploration
2024 · 4 citations
Mutual Information State Intrinsic Control
2021 · 3 citations
Improving Few-Shot Inductive Learning on Temporal Knowledge Graphs using Confidence-Augmented Reinforcement Learning
2023 · 3 citations
Mutual Information-based State-Control for Intrinsically Motivated Reinforcement Learning
2020 · 2 citations
Why long model-based rollouts are no reason for bad Q-value estimates
2024 · 1 citations
ProcessThinker: Enhancing Multi-modal Large Language Models Reasoning via Rollout-based Process Reward
2026
EchoRL: Reinforcement Learning via Rollout Echoing
2026
Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents
2026
Tool Verification for Test-Time Reinforcement Learning
2026
Top co-authors
Rui Zhao
· 7
Yunpu Ma
· 5
Jingpei Wu
· 3
Sikuan Yan
· 3
Yao Zhang
· 3
Zhen Han
· 3
Zifeng Ding
· 3
Ercong Nie
· 2
Jinhe Bi
· 2
Pieter Abbeel
· 2
Wei Xu
· 2
Yang Gao
· 2
Topics
Exploration
Policy Gradient
Model-Based RL
cs.AI
Value-Based
Meta-RL
Multi-Agent
cs.LG
cs.CL
Game AI