R-4R
Emerging7papers using it
2019first seen
The 'R-4R' dataset is used to evaluate vision-and-language navigation tasks by providing a benchmark for agents to navigate environments based on natural language instructions.
Papers using R-4R (7)
- PanoGen++: Domain-Adapted Text-Guided Panoramic Environment Generation
for Vision-and-Language NavigationHistory Aware Multimodal Transformer for Vision-and-Language NavigationNeighbor-view Enhanced Model for Vision and Language NavigationESceme: Vision-and-Language Navigation with Episodic Scene MemoryMultimodal Attention Networks for Low-Level Vision-and-Language
NavigationNavHint: Vision and Language Navigation Agent with a Hint GeneratorDELAN: Dual-Level Alignment for Vision-and-Language Navigation by
Cross-Modal Contrastive Learning