BenchMark·Hub
Benchmark测评分类可信级别开放热度
real-toxicity-prompts
· allenai
安全对齐越狱攻防
B待确认41.5
wildjailbreak
· allenai
安全对齐越狱攻防
B待确认36.4
AgentHarm
· UK AISI
安全对齐越狱攻防
S高可信32.9
llm-refusal-evaluation
· MultiverseComputingCAI
安全对齐越狱攻防
B待确认25.1
prompt-injections-benchmark
· rogue-security
安全对齐越狱攻防
B待确认20.2
vllm_safety_evaluation
· PahaII
安全对齐越狱攻防
B待确认18.9
Fraud-R1-LLM-Defense-Fraud-Benchmark
· Chouoftears
安全对齐越狱攻防
B待确认17.6
HarmBench
· CAIS
安全对齐越狱攻防
S高可信14.3
red-team-appsec-benchmark
· Qwovadis
安全对齐越狱攻防
B待确认12.7
StrongREJECT
· 多家
安全对齐越狱攻防
S高可信11.6
exploitgym
· sunblaze-ucb
安全对齐越狱攻防
B待确认11.2
combine-llm-security-benchmark
· tuandunghcmut
安全对齐越狱攻防
B待确认8.8
representational-collapse-llm-benchmark
· wu981526092
安全对齐越狱攻防
B待确认6.0
pi-detector-bench
· bastion-soft
安全对齐越狱攻防
B待确认0.0