Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Washim Uddin Mondal — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Washim Uddin Mondal
17
papers ·
13
citations ·
7
h-index
Indian Institute of Technology Kanpur
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
On the Approximation of Cooperative Heterogeneous Multi-Agent Reinforcement Learning (MARL) using Mean Field Control (MFC)
2021 · 6 citations
On the Near-Optimality of Local Policies in Large Cooperative Multi-Agent Reinforcement Learning
2022 · 3 citations
Mean-Field Control based Approximation of Multi-Agent Reinforcement Learning in Presence of a Non-decomposable Shared Global State
2023 · 1 citations
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
2023 · 1 citations
Improved Sample Complexity Analysis of Natural Policy Gradient Algorithm with General Parameterization for Infinite Horizon Discounted Reward Markov Decision Processes
2023 · 1 citations
Sample-Efficient Constrained Reinforcement Learning with General Parameterization
2024 · 1 citations
Global Convergence of Average Reward Constrained MDPs with Neural Critic and General Policy Parameterization
2026
Match or Replay: Self Imitating Proximal Policy Optimization
2026
Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm
2025
Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning
2025
Order-Optimal Regret with Novel Policy Gradient Approaches in Infinite-Horizon Average Reward MDPs
2024
Can Mean Field Control (MFC) Approximate Cooperative Multi Agent Reinforcement Learning (MARL) with Non-Uniform Interaction?
2022
Mean-Field Approximation of Cooperative Constrained Multi-Agent Reinforcement Learning (CMARL)
2022
Reinforcement Learning with Delayed, Composite, and Partially Anonymous Reward
2023
Learning General Parameterized Policies for Infinite Horizon Average Reward Constrained MDPs via Primal-Dual Policy Gradient Algorithm
2024
Top co-authors
Vaneet Aggarwal
· 14
Qinbo Bai
· 4
Satish V. Ukkusuri
· 3
and Satish V. Ukkusuri
· 2
Swetha Ganesh
· 2
and Vaneet Aggarwal
· 1
Anirudh Satheesh
· 1
Gaurav Chaudhary
· 1
Laxmidhar Behera
· 1
Mridul Agarwal
· 1
Pankaj Kumar Barman
· 1
Vaneet Aggarwal
· 1
Topics
Policy Gradient
Safe RL
Multi-Agent
Model-Based RL
Exploration
Value-Based
Meta-RL