HumanEval-plus
Emerging6papers using it
2024first seen
Papers using HumanEval-plus (6)
- Demystifying Errors in LLM Reasoning Traces: An Empirical Study of Code Execution SimulationBenchmarking AI Models in Software Engineering: A Review, Search Tool,
and Enhancement ProtocolACECODER: Acing Coder RL via Automated Test-Case SynthesisDynamic Scaling of Unit Tests for Code Reward ModelingUncovering Weaknesses in Neural Code GenerationMulti-Programming Language Ensemble for Code Generation in Large Language Model