← all datasets

SlideVQA

Emerging
3papers using it
958HF downloads
17HF likes
2025first seen

SlideVQA SlideVQA: A Dataset for Document Visual Question Answering on Multiple Images πŸ“– arXiv 🌐 github We introduce a new document VQA dataset, SlideVQA, for tasks wherein given a slide deck composed of multiple slide images and a corresponding question, a system selects a set of evidence images and answers the ques

Papers using SlideVQA (3)

SlideVQA dataset β€” papers, benchmarks & downloads Β· Multimodal