Procgen
Canonical15papers using it
389HF downloads
6HF likes
2024first seen
Procgen Benchmark This dataset contains expert trajectories generated by a PPO reinforcement learning agent trained on each of the 16 procedurally-generated gym environments from the Procgen Benchmark. The environments were created on distribution_mode=easy and with unlimited levels. Disclaimer: This is not an official
π€ Hugging Faceβ apache-2.0
Papers using Procgen (15)
- ULTHO: Ultra-Lightweight yet Efficient Hyperparameter Optimization in Deep Reinforcement LearningSparse Masked Attention Policies for Reliable GeneralizationUnderstanding and Improving Hyperbolic Deep Reinforcement LearningSynthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline DataImpoola: The Power of Average Pooling for Image-Based Deep Reinforcement LearningAdaptive Data Exploitation in Deep Reinforcement LearningA Dual-Agent Adversarial Framework for Robust Generalization in Deep Reinforcement LearningA Study of Plasticity Loss in On-Policy Deep Reinforcement LearningExplore-Go: Leveraging Exploration for Generalisation in Deep
Reinforcement LearningDo Agents Dream of Electric Sheep?: Improving Generalization in
Reinforcement Learning through Generative LearningFast TRAC: A Parameter-Free Optimizer for Lifelong Reinforcement
LearningPufferLib: Making Reinforcement Learning Libraries and Environments Play
NiceSiT: Symmetry-Invariant Transformers for Generalisation in Reinforcement
LearningMaximum Entropy On-Policy Actor-Critic via Entropy Advantage EstimationProvable Domain Adaptation for Offline Reinforcement Learning with Limited Samples