HotpotQA
Emerging10papers using it
1,874HF downloads
16HF likes
2024first seen
Dataset Card for BEIR Benchmark hotpotqa is one of the datasets from the Question Answering task within BEIR, measuring Wikipedia article retrieval for a given multi-hop query. Dataset Summary BEIR is a heterogeneous benchmark built from 18 diverse datasets representing 9 information retrieval tasks. Fact-checking: FEV
π€ Hugging Faceβ cc-by-sa-4.0
Papers using HotpotQA (10)
- StepOPSD: Step-Aware Online Preference Distillation for Agent Reinforcement LearningEMA Policy Gradient: Taming Reinforcement Learning for LLMs with EMA Anchor and Top-k KLLearning Query-Aware Budget-Tier Routing for Runtime Agent MemoryA$^2$Search: Ambiguity-Aware Question Answering with Reinforcement LearningSAGE: Strategy-Adaptive Generation Engine for Query RewritingVisual Agentic Reinforcement Fine-TuningSynthetic Data Generation & Multi-Step RL for Reasoning & Tool UseAGILE: A Novel Reinforcement Learning Framework of LLM AgentsIM-RAG: Multi-Round Retrieval-Augmented Generation Through Learning
Inner MonologuesEnhancing Decision-Making for LLM Agents via Step-Level Q-Value Models