← all datasets

CoSApien

Emerging
2papers using it
41HF downloads
1HF likes
2024first seen

CoSApien: A Human-Authored Safety Control Benchmark Paper: Controllable Safety Alignment: Inference-Time Adaptation to Diverse Safety Requirements, published at ICLR 2025. Purpose: Evaluate the controllability of large language models (LLMs) aligned through natural language safety configs, ensuring both helpfulness and

Papers using CoSApien (2)

CoSApien dataset β€” papers, benchmarks & downloads Β· Large Language Models