MBPP
Emerging13papers using it
168,974HF downloads
233HF likes
2024first seen
Dataset Card for Mostly Basic Python Problems (mbpp) Dataset Summary The benchmark consists of around 1,000 crowd-sourced Python programming problems, designed to be solvable by entry level programmers, covering programming fundamentals, standard library functionality, and so on. Each problem consists of a task descrip
π€ Hugging Faceβ cc-by-4.0
Papers using MBPP (13)
- Domain-Adaptable Reinforcement Learning for Code Generation with Dense RewardsRL with Learnable Textual Feedback: A Bilevel ApproachACECODER: Acing Coder RL via Automated Test-Case SynthesisSLIM-RL: Risk-Budgeted Random-Masking RL for Diffusion LLMs Without Trajectory SlicingPopuLoRA: Co-Evolving LLM Populations for Reasoning Self-PlayBeyond Execution: Static-Analysis Rewards and Hint-Conditioned Diffusion RL for Code GenerationMIST-RL: Mutation-based Incremental Suite Testing via Reinforcement LearningReflexiCoder: Teaching Large Language Models to Self-Reflect on Generated Code and Self-Correct It via Reinforcement LearningExecution-Grounded Credit Assignment for GRPO in Code GenerationBeyond KL Divergence: Policy Optimization with Flexible Bregman Divergences for LLM ReasoningReinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code GenerationFALCON: Feedback-driven Adaptive Long/short-term memory reinforced Coding Optimization systemPolicy Filtration for RLHF to Mitigate Noise in Reward Models