ScienceQA
Canonical29papers using it
2023first seen
This is the ScientificQA dataset by Saikh et al (2022). @article{10.1007/s00799-022-00329-y, author = {Saikh, Tanik and Ghosal, Tirthankar and Mittal, Amish and Ekbal, Asif and Bhattacharyya, Pushpak}, title = {ScienceQA: A Novel Resource for Question Answering on Scholarly Articles}, year = {2022}, journal = {Int. J.
Papers using ScienceQA (29)
- Reasoning in the Dark: Interleaved Vision-Text Reasoning in Latent SpaceMorphoQuant: Modality-Aware Quantization for Omni-modal Large Language ModelsData-Driven Calibration of Prediction Sets in Large Vision-Language Models Based on Inductive Conformal PredictionTVI-CoT: Text-Visual Interleaved Chain-of-Thought Reasoning for Multimodal UnderstandingHierarchical Pre-Training of Vision Encoders with Large Language ModelsMultilingual Training and Evaluation Resources for Vision-Language ModelsHiPP-Prune: Hierarchical Preference-Conditioned Structured Pruning for Vision-Language ModelsSCoOP: Semantic Consistent Opinion Pooling for Uncertainty Quantification in Multiple Vision-Language Model SystemsHistory-Guided Iterative Visual Reasoning with Self-CorrectionText-Guided Layer Fusion Mitigates Hallucination in Multimodal LLMsCASHEW: Stabilizing Multimodal Reasoning via Iterative Trajectory AggregationEnhancing Scientific Visual Question Answering via Vision-Caption aware Supervised Fine-TuningQianfan-vl: Domain-enhanced Universal Vision-language ModelsCoRGI: Verified Chain-of-Thought Reasoning with Post-hoc Visual GroundingInverse-LLaVA: Rethinking Multimodal Alignment via Text-to-Vision MappingMultimodal Chain of Continuous Thought for Latent-Space Reasoning in Vision-Language ModelsChain of Questions: Guiding Multimodal Curiosity in Language ModelsFast or Slow? Integrating Fast Intuition and Deliberate Thinking for Enhancing Visual Question AnsweringASCD: Attention-Steerable Contrastive Decoding for Reducing Hallucination in MLLMElevating Visual Question Answering through Implicitly Learned Reasoning
Pathways in LVLMsOn the robustness of multimodal language model towards distractions2.5 Years in Class: A Multimodal Textbook for Vision-Language PretrainingInstructBLIP: Towards General-purpose Vision-Language Models with
Instruction TuningMultimodal Chain-of-Thought Reasoning in Language ModelsUnlock the Power: Competitive Distillation for Multi-Modal Large
Language ModelsVLIS: Unimodal Language Models Guide Multimodal Language GenerationMultiQG-TI: Towards Question Generation from Multi-modal SourcesTowards a Unified Multimodal Reasoning FrameworkRetrieval Meets Reasoning: Even High-school Textbook Knowledge Benefits
Multimodal Reasoning