← all datasets

ARC-AGI-3

Emerging
7papers using it
2025first seen

The ARC-AGI-3 dataset/benchmark contains a set of game-playing challenges used to evaluate the performance and learning capabilities of large language model (LLM) agents in dynamic environments.

Papers using ARC-AGI-3 (3)

ARC-AGI-3 dataset β€” papers, benchmarks & downloads Β· AI Agents