KernelBench
Emerging17papers using it
2,872HF downloads
50HF likes
2025first seen
KernelBench A benchmark designed to evaluate the ability of LLMs to generate efficient GPU kernels for optimizing neural network performance Version [07-21-2025] This HF dataset version has been updated to v0.1 Citation @misc{ouyang2024kernelbench, title={KernelBench: Can LLMs Write GPU Kernels?}, author={Anne Ouyang a
Papers using KernelBench (17)
- CUDA Agent: Large-Scale Agentic RL for High-Performance CUDA Kernel GenerationHTAM: Hierarchical Transition-Attended Memory for Operator OptimizationCUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement LearningCUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement
LearningKernelBench: Can LLMs Write Efficient GPU Kernels?StitchCUDA: An Automated Multi-Agents End-to-End GPU Programing Framework with Rubric-based Agentic Reinforcement LearningMaking LLMs Optimize Multi-Scenario CUDA Kernels Like ExpertsKernelFoundry: Hardware-aware evolutionary GPU kernel optimizationFine-Tuning GPT-5 for GPU Kernel GenerationDICE: Diffusion Large Language Models Excel at Generating CUDA KernelsDr. Kernel: Reinforcement Learning Done Right for Triton Kernel GenerationsMaxCode: A Max-Reward Reinforcement Learning Framework for Automated Code OptimizationCudaForge: An Agent Framework with Hardware Feedback for CUDA Kernel OptimizationSTARK: Strategic Team of Agents for Refining KernelsTritonRL: Training LLMs to Think and Code Triton Without CheatingAutoTriton: Automatic Triton Programming with Reinforcement Learning in LLMsAutoTriton: Automatic Triton Programming with Reinforcement Learning in
LLMs