MPE
Emerging19papers using it
30HF downloads
0HF likes
2024first seen
Overview Original dataset here. Dataset curation Same data and splits as the original. The following columns have been added: premise: concatenation of premise1, premise2, premise3, and premise4 label: encoded gold_label with the following mapping {"entailment": 0, "neutral": 1, "contradiction": 2} Code to create the d
Papers using MPE (19)
- CCL: Collaborative Curriculum Learning for Sparse-Reward Multi-Agent Reinforcement Learning via Co-evolutionary Task EvolutionCoFlow: Coordinated Few-Step Flow for Offline Multi-Agent Decision MakingQuality-Aware Exploration Budget Allocation for Cooperative Multi-Agent Reinforcement LearningKD-MARL: Resource-Aware Knowledge Distillation in Multi-Agent Reinforcement LearningSTAIRS-Former: Spatio-Temporal Attention with Interleaved Recursive Structure Transformer for Offline Multi-task Multi-agent Reinforcement LearningDual-Gated Epistemic Time-Dilation: Autonomous Compute Modulation in Asynchronous MARLLearning Partial Action Replacement in Offline MARLDiffusing to Coordinate: Efficient Online Multi-Agent Diffusion PoliciesProbing Dec-POMDP Reasoning in Cooperative MARLBandwidth-constrained Variational Message Encoding for Cooperative Multi-agent Reinforcement LearningMulti-party Agent Relation Sampling for Multi-party Ad Hoc Teamwork$Agent^2$: An Agent-Generates-Agent Framework for Reinforcement Learning AutomationCentralized Permutation Equivariant Policy for Cooperative Multi-Agent Reinforcement LearningRainbow Delay Compensation: A Multi-Agent Reinforcement Learning Framework for Mitigating Delayed ObservationEnhancing Cooperative Multi-Agent Reinforcement Learning with State Modelling and Adversarial ExplorationJaxRobotarium: Training and Deploying Multi-Robot Policies in 10 MinutesDual Ensembled Multiagent Q-Learning with Hypernet RegularizerBoosting Sample Efficiency and Generalization in Multi-agent
Reinforcement Learning via EquivarianceStop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration