RxR
Emerging11papers using it
2021first seen
The 'RxR' dataset is a benchmark used to evaluate Vision-Language Navigation (VLN) tasks, containing navigation instructions paired with visual data to assess the performance of models in understanding and executing these instructions.
Papers using RxR (11)
- pFedNavi: Structure-Aware Personalized Federated Vision-Language Navigation for Embodied AIFine-Grained Instruction-Guided Graph Reasoning for Vision-and-Language NavigationVision-and-Language Navigation via Causal LearningHistory Aware Multimodal Transformer for Vision-and-Language NavigationHOP: History-and-Order Aware Pre-training for Vision-and-Language
NavigationA New Path: Scaling Vision-and-Language Navigation with Synthetic
Instructions and Imitation LearningVLN-PETL: Parameter-Efficient Transfer Learning for Vision-and-Language
NavigationCausality-based Cross-Modal Representation Learning for
Vision-and-Language NavigationDELAN: Dual-Level Alignment for Vision-and-Language Navigation by
Cross-Modal Contrastive LearningWhy Only Text: Empowering Vision-and-Language Navigation with
Multi-modal PromptsNAVCON: A Cognitively Inspired and Linguistically Grounded Corpus for
Vision and Language Navigation