← all datasets

C-Eval (hard)

Emerging
1papers using it
2023first seen

'C-Eval (hard)' is a benchmark used to evaluate the performance of language models on challenging Chinese language tasks.

Papers using C-Eval (hard) (1)

C-Eval (hard) dataset β€” papers, benchmarks & downloads Β· AI for Code