Waymo
Emerging8papers using it
2025first seen
Waymo is a dataset that contains annotated real-world traffic scenarios used to evaluate the spatial reasoning and scene understanding capabilities of Vision Language Models through Visual Question Answering.
Papers using Waymo (8)
- Embodied Scene Understanding for Vision Language Models via MetaVQANoRD: A Data-Efficient Vision-Language-Action Model that Drives without ReasoningGoal-based Vision-language DrivingAutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-TuningNurisk: A Visual Question Answering Dataset For Agent-level Risk Assessment In Autonomous DrivingNav-ee: Navigation-guided Early Exiting For Efficient Vision-language Models In Autonomous DrivingAD-EE: Early Exiting For Fast And Reliable Vision-language Models In Autonomous DrivingMMHU: A Massive-scale Multimodal Benchmark For Human Behavior Understanding