Meta-World
Canonical62papers using it
2024first seen
A benchmark of 50 robotic manipulation tasks for multi-task and meta-reinforcement learning.
Papers using Meta-World (62)
- UBP2: Uncertainty-Balanced Preference Planning for Efficient Preference-based Reinforcement LearningLaGO: Latent Action Guidance for Online Reinforcement LearningWhen are LLMs Sufficient Policy Optimizers for Sequential RL Tasks?Policy Learning from Large Vision-Language Model Feedback without Reward ModelingSPHERE: Mitigating the Loss of Spectral Plasticity in Mixture-of-Experts for Deep Reinforcement LearningRevisiting Mixture Policies in Entropy-Regularized Actor-CriticOne for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement LearningTOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic BalancingGIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination ControlMVR: Multi-view Video Reward Shaping for Reinforcement LearningSEAR: Sample Efficient Action Chunking Reinforcement LearningContextual Latent World Models for Offline Meta Reinforcement LearningProgAgent:A Continual RL Agent with Progress-Aware RewardsRewarding DINO: Predicting Dense Rewards with Vision Foundation ModelsR2-Dreamer: Redundancy-Reduced World Models without Decoders or AugmentationMixture-of-World Models: Scaling Multi-Task Reinforcement Learning with Modular Latent DynamicsMARVL: Multi-Stage Guidance for Robotic Manipulation via Vision-Language ModelsTask-Aware Exploration via a Predictive Bisimulation MetricEvaluating Feature Dependent Noise in Preference-based Reinforcement LearningTrust, Don't Trust, or Flip: Robust Preference-Based Reinforcement Learning with Multi-Expert FeedbackContinual Policy Distillation from Distributed Reinforcement Learning TeachersGoal-Driven Reward by Video Diffusion Models for Reinforcement LearningScalable Multi-Objective and Meta Reinforcement Learning via Gradient EstimationSoft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement LearningMulti-Task Reinforcement Learning with Language-Encoded Gated Policy NetworksIn-Context Policy Adaptation via Cross-Domain Skill DiffusionGoal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement LearningRevisiting Bisimulation Metric for Robust Representations in Reinforcement LearningResidual Reward Models for Preference-based Reinforcement LearningBalancing Expressivity and Robustness: Constrained Rational Activations for Reinforcement LearningVITA: Zero-Shot Value Functions via Test-Time Adaptation of Vision-Language ModelsMeta-World+: An Improved, Standardized, RL BenchmarkTime Reversal Symmetry for Efficient Robotic Manipulations in Deep Reinforcement LearningNeuron-level Balance between Stability and Plasticity in Deep
Reinforcement LearningText-to-Decision Agent: Offline Meta-Reinforcement Learning from Natural Language SupervisionLearning Policy Committees for Effective Personalization in MDPs with Diverse TasksPreference VLM: Leveraging VLMs for Scalable Preference-Based
Reinforcement LearningTask-Aware Virtual Training: Enhancing Generalization in Meta-Reinforcement Learning for Out-of-Distribution TasksModel Evolution Framework with Genetic Algorithm for Multi-Task
Reinforcement LearningDistilling Reinforcement Learning Algorithms for In-Context Model-Based
PlanningSubtask-Aware Visual Reward Learning from Segmented DemonstrationsEffective Exploration Based on the Structural Information PrinciplesA Recipe for Unbounded Data Augmentation in Visual Reinforcement
LearningMeta-DT: Offline Meta-RL as Conditional Sequence Modeling with World
Model DisentanglementReset & Distill: A Recipe for Overcoming Negative Transfer in Continual Reinforcement LearningBigger, Regularized, Optimistic: scaling for compute and
sample-efficient continuous controlFuRL: Visual-Language Models as Fuzzy Rewards for Reinforcement LearningCentralized Reward Agent for Knowledge Sharing and Transfer in Multi-Task Reinforcement LearningGeneralizing Consistency Policy to Visual RL with Prioritized Proximal
Experience RegularizationState Chrono Representation for Enhancing Generalization in
Reinforcement LearningHierarchical Meta-Reinforcement Learning via Automated Macro-Action
DiscoveryHindsight PRIORs for Reward Learning from Human PreferencesOMPO: A Unified Framework for RL under Policy and Dynamics ShiftsShared-unique Features and Task-aware Prioritized Sampling on Multi-task
Reinforcement LearningText-Aware Diffusion for Policy LearningForward KL Regularized Preference Optimization for Aligning Diffusion
PoliciesTask-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion PlannerMake the Pertinent Salient: Task-Relevant Reconstruction for Visual
Control with DistractionsA Large Language Model-Driven Reward Design Framework via Dynamic
Feedback for Reinforcement LearningRobot Policy Learning with Temporal Optimal Transport RewardHierarchical Prompt Decision Transformer: Improving Few-Shot Policy
Generalization with Global and Adaptive GuidanceOnline Preference-based Reinforcement Learning with Self-augmented
Feedback from Large Language Model