HumanEval-XL
Emerging8papers using it
2023first seen
A collection of cross-lingual benchmark for code generation.
Papers using HumanEval-XL (8)
- Strategies for Guiding LLMs to Use Software Design Patterns: A Case of SingletonSwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code EvaluationEnhancing LLM-Based Code Translation with Verified Multi-Semantic RepresentationsProgramming Language Confusion: When Code LLMs Can't Keep their Languages StraightMutation-based Consistency Testing for Evaluating the Code Understanding
Capability of LLMsHumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual
Natural Language GeneralizationCodeFuse-13B: A Pretrained Multi-lingual Code Large Language ModelInterTrans: Leveraging Transitive Intermediate Translations to Enhance LLM-based Code Translation