← all papers · overview

Medmt-bench: Can Llms Memorize And Understand Long Multi-turn Conversations In Medical Scenarios?

Abstract

Large Language Models (LLMs) have demonstrated impressive capabilities across various specialist domains and have been integrated into high-stakes areas such as medicine. However, as existing medical-related benchmarks rarely stress-test the long-context memory, interference robustness, and safety defense required in practice. To bridge this gap, we introduce MedMT-Bench, a challenging medical mul

Related papers

Ranked by semantic similarity — how closely each paper's abstract matches this one (100% = near-identical topic).