MMMU
Emerging5papers using it
55,283HF downloads
331HF likes
2025first seen
MMMU (A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI) π Homepage | π Leaderboard | π€ Dataset | π€ Paper | π arXiv | GitHub πNews π οΈ[2026-07-10]: Fixed incorrect ground-truth answer labels in validation_Design_15 and validation_Art_Theory_4. π οΈ[2026-04-21]: Fixed option
π€ Hugging Faceβ apache-2.0
Papers using MMMU (5)
- VisPlay: Self-Evolving Vision-Language Models from ImagesLLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy ModelDreamPRM-1.5: Unlocking the Potential of Each Instance for Multimodal Process Reward Model TrainingTraining Vision-Language Process Reward Models for Test-Time Scaling in Multimodal Reasoning: Key Insights and Lessons LearnedReinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training