← all datasets

MM-IFEval

Emerging
2papers using it
2025first seen

MM-IFEval is a challenging and diverse multi-modal instruction-following benchmark that evaluates the performance of Multi-modal Large Language Models (MLLMs) using both compose-level and perception-level constraints.

Papers using MM-IFEval (1)

MM-IFEval dataset β€” papers, benchmarks & downloads Β· Large Language Models