Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Shunyu Liu — most-cited papers & profile · Multimodal
← authors
·
overview
Shunyu Liu
39
papers ·
315
citations ·
17
h-index
The University of Queensland · Nanyang Technological University · Nanjing Institute of Technology · Zhejiang University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization
2025 · 274 citations
A Survey on Explainable Reinforcement Learning: Concepts, Algorithms, Challenges
2022 · 13 citations
Is Centralized Training with Decentralized Execution Framework Centralized Enough for MARL?
2023 · 12 citations
Parallelized Planning-acting For Efficient Llm-based Multi-agent Systems In Minecraft
2025 · 5 citations
Multi-Agent Continuous Control with Generative Flow Networks
2024 · 3 citations
Ask-AC: An Initiative Advisor-in-the-Loop Actor-Critic Framework
2022 · 2 citations
Temporal Prototype-Aware Learning for Active Voltage Control on Power Distribution Networks
2024 · 2 citations
Bi-level Mean Field: Dynamic Grouping for Large-Scale MARL
2025 · 1 citations
Interaction Pattern Disentangling for Multi-Agent Reinforcement Learning
2022 · 1 citations
Improving Expressivity of GNNs with Subgraph-specific Factor Embedded Normalization
2023 · 1 citations
Message-passing selection: Towards interpretable GNNs for graph classification
2023 · 1 citations
OpenClaw-Skill: Collective Skill Tree Search for Agentic Large Language Models
2026
OpenClaw-Skill: Collective Skill Tree Search for Agentic Large Language Models
2026
Entropy Pacing Policy Optimization for Multi-Task Agentic Reinforcement Learning
2026
Entropy Pacing Policy Optimization for Multi-Task Agentic Reinforcement Learning
2026
Topics
Model-Based RL
Multi-Agent
RLHF & Alignment
Exploration
GNN Architectures
Theory & Expressivity
Policy Gradient
Offline RL
Reinforcement Learning
Training Techniques