LiveCodeBench
Emerging22papers using it
2025first seen
'LiveCodeBench' is a benchmark dataset used to evaluate the performance of reasoning models in code generation tasks.
Papers using LiveCodeBench (22)
- Kimi k1.5: Scaling Reinforcement Learning with LLMsThinking-Free Policy Initialization Makes Distilled Reasoning Models More Effective and Efficient ReasonersRing-lite: Scalable Reasoning via C3PO-Stabilized Reinforcement Learning for LLMsDon't Let Gains FADE: Breaking Down Policy Gradient Weights in RLACECODER: Acing Coder RL via Automated Test-Case SynthesisProcess Reward Models That ThinkLearning to Orchestrate Agents in Natural Language with the ConductorPopuLoRA: Co-Evolving LLM Populations for Reasoning Self-PlayBeyond Execution: Static-Analysis Rewards and Hint-Conditioned Diffusion RL for Code GenerationApriel-1.5-OpenReasoner: RL Post-Training for General-Purpose and Efficient ReasoningReflexiCoder: Teaching Large Language Models to Self-Reflect on Generated Code and Self-Correct It via Reinforcement LearningSAGE: Multi-Agent Self-Evolution for LLM ReasoningBridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code GenerationLLMs Can Learn to Reason Via Off-Policy RLCLEANER: Self-Purified Trajectories Boost Agentic Reinforcement LearningFunPRM: Function-as-Step Process Reward Model with Meta Reward Correction for Code GenerationAgnostics: Learning to Code in Any Programming Language via Reinforcement with a Universal Learning EnvironmentSample More to Think Less: Group Filtered Policy Optimization for Concise ReasoningReVeal: Self-Evolving Code Agents via Reliable Self-VerificationAceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement LearningSkywork Open Reasoner 1 Technical ReportSRPO: A Cross-Domain Implementation of Large-Scale Reinforcement
Learning on LLM