BenchMark·Hub

humaine-evaluation-dataset

B待确认Benchmark
安全对齐对齐安全开放mit

发布方:ProlificAI

热度12.2▼ 0.1
下载量 · 30天
156
Hugging Face
GitHub Stars
代码仓库
论文被引
Semantic Scholar
跑分模型 · 30天
Leaderboard results

简介

HUMAINE: Human-AI Interaction Evaluation Dataset Dataset Description Dataset Summary The HUMAINE dataset contains human evaluations of AI model interactions across diverse demographic groups and conversation contexts. This dataset powers the HUMAINE Leaderboard, providing insights into how different AI models perform across various user populations and use cases. The dataset consists of two main components: Feedback Comparisons: Pairwise model comparisons… See the full description on the dataset page: https://huggingface.co/datasets/ProlificAI/humaine-evaluation-dataset.