Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Haifeng Zhang — most-cited papers & profile · AI for Code
← authors
·
overview
Haifeng Zhang
28
papers ·
75
citations ·
47
h-index
Nanjing University of Posts and Telecommunications
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
GCS: Graph-based Coordination Strategy for Multi-Agent Reinforcement Learning
2022 · 25 citations
Settling the Variance of Multi-Agent Policy Gradients
2021 · 24 citations
Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks
2021 · 11 citations
Learning to Design Games: Strategic Environments in Reinforcement Learning
2017 · 4 citations
Contextual Transformer for Offline Meta Reinforcement Learning
2022 · 4 citations
Proactive Constrained Policy Optimization with Preemptive Penalty
2025 · 2 citations
Bi-level Actor-Critic for Multi-agent Coordination
2019 · 2 citations
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning
2021 · 2 citations
An Empirical Study on Google Research Football Multi-agent Scenarios
2023 · 1 citations
UniMem: Complementary Episodic-to-Parametric Memory for Boundary-Agnostic Task Streams
2026
Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs
2026
$π$-StepNFT: Wider Space Needs Finer Steps in Online RL for Flow-based VLAs
2026
Swimming Under Constraints: A Safe Reinforcement Learning Framework for Quadrupedal Bio-Inspired Propulsion
2026
Memory-Driven Self-Improvement for Decision Making with Large Language Models
2025
Enhancing Efficiency and Propulsion in Bio-mimetic Robotic Fish through End-to-End Deep Reinforcement Learning
2025
Top co-authors
Chenheng Zhang
· 1
Guojun Yin
· 1
Haoxuan Li
· 1
Jiajun Chai
· 1
Jun Wang
· 1
Siyu Xia
· 1
Wei Lin
· 1
Xiaohan Wang
· 1
Yanting Wu
· 1
Zhouchen Lin
· 1
Topics
Game AI
Multi-Agent
Policy Gradient
Model-Based RL
Offline RL
Exploration
Efficiency
Training Techniques
Control
Locomotion