← all papers · overview

Llms Can Be Dangerous Reasoners: Analyzing-based Jailbreak Attack On Large Language Models

Abstract

The rapid development of Large Language Models (LLMs) has brought impressive advancements across various tasks. However, despite these achievements, LLMs still pose inherent safety risks, especially in the context of jailbreak attacks. Most existing jailbreak methods follow an input-level manipulation paradigm to bypass safety mechanisms. Yet, as alignment techniques improve, such attacks are beco

Related papers

Ranked by semantic similarity — how closely each paper's abstract matches this one (100% = near-identical topic).