Fraud-R1-LLM-Defense-Fraud-Benchmark
B待确认Benchmark安全对齐越狱攻防申请mit
发布方:Chouoftears
热度17.6▼ 0.3
下载量 · 30天
62
Hugging Face
GitHub Stars
—
代码仓库
论文被引
43
Semantic Scholar
跑分模型 · 30天
—
Leaderboard results
简介
Fraud-R1 : A Comprehensive Benchmark for Assessing LLM Robustness Against Fraud and Phishing Inducement Shu Yang*, Shenzhe Zhu*, Zeyu Wu, Keyu Wang, Junchi Yao, Junchao Wu, Lijie Hu, Mengdi Li, Derek F. Wong, Di Wang† (*Contribute equally, †Corresponding author) 😃 Github | 📜 Project Page | 📝 arxiv ❗️Content Warning: This repo contains examples of harmful language. 📰 News 2025/02/16: ❗️We have released our evaluation code. 2025/02/16: ❗️We have released our dataset.… See the full description on the dataset page: https://huggingface.co/datasets/Chouoftears/Fraud-R1-LLM-Defense-Fraud-Benchmark.