MultiModalQA
Emerging4papers using it
2023first seen
The 'MultiModalQA' dataset/benchmark contains multimodal data that is used to evaluate question answering tasks requiring reasoning across multiple modalities, such as text and visual information.
Papers using MultiModalQA (4)
- VLMT: Vision-Language Multimodal Transformer for Multimodal Multi-hop
Question AnsweringMultimodal Graph Transformer for Multimodal Question AnsweringMoqaGPT : Zero-Shot Multi-modal Open-domain Question Answering with
Large Language ModelMMHQA-ICL: Multimodal In-context Learning for Hybrid Question Answering
over Text, Tables and Images