BenchMark·Hub

Fraud-R1-LLM-Defense-Fraud-Benchmark

B待确认Benchmark
安全对齐越狱攻防申请mit

发布方:Chouoftears

热度17.6▼ 0.3
下载量 · 30天
62
Hugging Face
GitHub Stars
代码仓库
论文被引
43
Semantic Scholar
跑分模型 · 30天
Leaderboard results

简介

Fraud-R1 : A Comprehensive Benchmark for Assessing LLM Robustness Against Fraud and Phishing Inducement Shu Yang*, Shenzhe Zhu*, Zeyu Wu, Keyu Wang, Junchi Yao, Junchao Wu, Lijie Hu, Mengdi Li, Derek F. Wong, Di Wang† (*Contribute equally, †Corresponding author) 😃 Github | 📜 Project Page | 📝 arxiv ❗️Content Warning: This repo contains examples of harmful language. 📰 News 2025/02/16: ❗️We have released our evaluation code. 2025/02/16: ❗️We have released our dataset.… See the full description on the dataset page: https://huggingface.co/datasets/Chouoftears/Fraud-R1-LLM-Defense-Fraud-Benchmark.