Awesome Reinforcement Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Hangyu Mao — most-cited papers & profile · Reinforcement Learning
← authors
·
overview
Hangyu Mao
39
papers ·
300
citations ·
13
h-index
Kuaishou (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Modelling the Dynamic Joint Policy of Teammates with Attention Multi-agent DDPG
2018 · 53 citations
ACCNet: Actor-Coordinator-Critic Net for "Learning-to-Communicate" with Deep Multi-agent Reinforcement Learning
2017 · 40 citations
Reward Design in Cooperative Multi-agent Reinforcement Learning for Packet Routing
2020 · 19 citations
CoSLight: Co-optimizing Collaborator Selection and Decision-making to Enhance Traffic Signal Control
2024 · 17 citations
Learning Multi-agent Communication under Limited-bandwidth Restriction for Internet Packet Routing
2019 · 11 citations
Learning Agent Communication under Limited Bandwidth by Message Pruning
2019 · 10 citations
An Efficient Transfer Learning Framework for Multiagent Reinforcement Learning
2020 · 10 citations
Cooperative Multi-Agent Transfer Learning with Level-Adaptive Credit Assignment
2021 · 10 citations
Breaking the Curse of Dimensionality in Multiagent State Space: A Unified Agent Permutation Framework
2022 · 10 citations
Learning to Collaborate by Grouping: a Consensus-oriented Strategy for Multi-agent Reinforcement Learning
2023 · 7 citations
Neighborhood Cognition Consistent Multi-Agent Reinforcement Learning
2019 · 6 citations
Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
2025 · 4 citations
PTDE: Personalized Training with Distilled Execution for Multi-Agent Reinforcement Learning
2022 · 4 citations
Transformer in Transformer as Backbone for Deep Reinforcement Learning
2022 · 2 citations
What About Inputing Policy in Value Function: Policy Representation and Policy-extended Value Function Approximator
2020 · 1 citations
Top co-authors
Jianye Hao
· 7
Jingqing Ruan
· 6
Zhen Xiao
· 5
Haoyuan Jiang
· 4
Wulong Liu
· 4
Xiaotian Hao
· 4
Zhibo Gong
· 4
Hua Wei
· 3
Weixun Wang
· 3
Xuantang Xiong
· 3
Yaodong Yang
· 3
Yiqun Chen
· 3
Topics
Multi-Agent
Model-Based RL
Value-Based
Policy Gradient
Game AI
Meta-RL
RLHF & Alignment
Exploration
Offline RL
Safe RL