← all papers · overview

Mossbench: Is Your Multimodal Language Model Oversensitive To Safe Queries?

Abstract

Humans are prone to cognitive distortions -- biased thinking patterns that lead to exaggerated responses to specific stimuli, albeit in very different contexts. This paper demonstrates that advanced Multimodal Large Language Models (MLLMs) exhibit similar tendencies. While these models are designed to respond queries under safety mechanism, they sometimes reject harmless queries in the presence of

Related papers

Ranked by semantic similarity — how closely each paper's abstract matches this one (100% = near-identical topic).