EvQA
Emerging10papers using it
2024first seen
The 'EVQA' dataset/benchmark contains samples designed to evaluate the explainability and trustworthiness of Visual Question Answering (VQA) models by focusing on the generation of visual and textual rationales for predicted answers.
Papers using EvQA (10)
- ProMSA:Progressive Multimodal Search Agents for Knowledge-Based Visual Question AnsweringEnhancing Visual Question Answering with Multimodal LLMs via Chain-of-Question Guided Retrieval-Augmented GenerationRegion-R1: Reinforcing Query-Side Region Cropping for Multi-Modal Re-RankingWikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question AnsweringLearning to Search: A Decision-Based Agent for Knowledge-Based Visual Question AnsweringWhen RAG Hurts: Diagnosing and Mitigating Attention Distraction in Retrieval-Augmented LVLMsCC-VQA: Conflict- and Correlation-Aware Method for Mitigating Knowledge Conflict in Knowledge-Based Visual Question AnsweringReconstruction as a Bridge for Event-Based Visual Question AnsweringKnowledge-based Visual Question Answer with Multimodal Processing, Retrieval and FilteringMultimodal Rationales for Explainable Visual Question Answering