BenchMark
·
Hub
总览
Benchmark 库
热度榜
家族
搜索 benchmark
⌘K
搜索
开放度
全部开放度
开放
需申请
闭集
未知
可信级别
全部可信级别
S · 高可信
A · 已审核
B · 待确认
应用筛选
共
39
个 benchmark
排序:
热度
增速
下载量
Stars
被引
最新
名称
Benchmark
测评分类
可信级别
开放
热度
下载(30d)
Stars
被引
real-toxicity-prompts
· allenai
安全对齐
越狱攻防
B
待确认
41.5
48,191
—
1,818
wildjailbreak
· allenai
安全对齐
越狱攻防
B
待确认
36.4
7,006
—
221
WMDP
· 学术联盟
安全对齐
对齐安全
S
高可信
36.2
26,532
—
515
civil_comments
· google
安全对齐
偏见公平
B
待确认
35.5
13,462
—
631
AgentHarm
· UK AISI
安全对齐
越狱攻防
S
高可信
32.9
4,598
—
368
openai-moderation-api-evaluation
· mmathys
安全对齐
对齐安全
B
待确认
32.1
2,956
—
492
coconot
· allenai
安全对齐
对齐安全
B
待确认
30.7
2,155
—
111
BeaverTails-Evaluation
· PKU-Alignment
安全对齐
对齐安全
B
待确认
29.7
708
—
1,030
prosocial-dialog
· allenai
安全对齐
对齐安全
B
待确认
28.8
865
—
162
llm-refusal-evaluation
· MultiverseComputingCAI
安全对齐
越狱攻防
B
待确认
25.1
201
—
615
Bias-Evaluation-Turkish
· orhunc
安全对齐
偏见公平
B
待确认
24.2
213
—
742
Gender_Bias_Evaluation_Set
· flax-sentence-embeddings
安全对齐
偏见公平
B
待确认
23.8
154
—
476
ValuePrism
· allenai
安全对齐
对齐安全
B
待确认
23.2
161
—
132
MASK
· cais
安全对齐
对齐安全
B
待确认
21.3
8,910
—
—
prompt-injections-benchmark
· rogue-security
安全对齐
越狱攻防
B
待确认
20.2
831
—
—
vllm_safety_evaluation
· PahaII
安全对齐
越狱攻防
B
待确认
18.9
50
—
114
Fraud-R1-LLM-Defense-Fraud-Benchmark
· Chouoftears
安全对齐
越狱攻防
B
待确认
17.6
62
—
43
social_bias_frames
· allenai
安全对齐
偏见公平
B
待确认
16.3
585
—
—
HarmBench
· CAIS
安全对齐
越狱攻防
S
高可信
14.3
—
—
1,467
red-team-appsec-benchmark
· Qwovadis
安全对齐
越狱攻防
B
待确认
12.7
115
—
—
humaine-evaluation-dataset
· ProlificAI
安全对齐
对齐安全
B
待确认
12.2
156
—
—
StrongREJECT
· 多家
安全对齐
越狱攻防
S
高可信
11.6
—
—
374
exploitgym
· sunblaze-ucb
安全对齐
越狱攻防
B
待确认
11.2
—
842
—
mittens
· google
安全对齐
偏见公平
B
待确认
10.9
68
—
—
equity_evaluation_corpus
· peixian
安全对齐
偏见公平
B
待确认
10.5
73
—
—
第 1 / 2 页
上一页
下一页