ja-vicuna-qa-benchmark
B待确认Benchmark语言/语义通用问答开放apache-2.0
发布方:llm-book
热度6.4▼ 0.1
下载量 · 30天
26
Hugging Face
GitHub Stars
—
代码仓库
论文被引
—
Semantic Scholar
跑分模型 · 30天
—
Leaderboard results
简介
Dataset Card for llm-book/ja-vicuna-qa-benchmark 書籍『大規模言語モデル入門Ⅱ〜生成型LLMの実装と評価』で使用する、京都大学が提供する「Japanese Vicuna QA Benchmark」のデータセットです。 オリジナルのサイトと同じものを使用しています。 本データセットは、10のカテゴリー(汎用、コーディング、ロールプレイ、ライティングなど)にわたる80の多様な質問で構成されており、LLM-as-a-judgeを使用して、参照なしで日本語LLMモデルの回答を評価することができます。 Licence Apache License, Version 2.0