AMC
Emerging21papers using it
34HF downloads
0HF likes
2025first seen
The 'AMC' dataset/benchmark contains a collection of mathematical reasoning problems used to evaluate the performance of large language models in solving multi-step mathematical tasks.
Papers using AMC (21)
- Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data ContaminationLogic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement
LearningPrune-OPD: Efficient and Reliable On-Policy Distillation for Long-Horizon ReasoningLLM Reasoning with Process Rewards for Outcome-Guided StepsTool Verification for Test-Time Reinforcement LearningPrAg-PO: Prompt Augmented Policy Optimization for Robust and Diverse Mathematical ReasoningBoosting LLM Reasoning via Human-Inspired Reward ShapingDementia-R1: Reinforced Pretraining and Reasoning from Unstructured Clinical Notes for Real-World Dementia PrognosisTransformation-Augmented GRPO for Enhancing Exploration in Reasoning of Large Language ModelsTraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM ReasoningCan LLMs Guide Their Own Exploration? Gradient-Guided Reinforcement Learning for LLM ReasoningScRPO: From Errors to InsightsGRPO-$\lambda$: Credit Assignment improves LLM ReasoningPlan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM ReasoningPinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement LearningCLAWS:Creativity detection for LLM-generated solutions using Attention Window of SectionsInpainting-Guided Policy Optimization for Diffusion Large Language ModelsWirelessMathLM: Teaching Mathematical Reasoning for LLMs in Wireless Communications with Reinforcement LearningEnhancing Math Reasoning in Small-sized LLMs via Preview Difficulty-Aware InterventionTemplateRL: Structured Template-Guided Reinforcement Learning for LLM ReasoningMaximizing Confidence Alone Improves Reasoning