BenchMark·Hub

LLMs-Planning

B待确认Benchmark
推理通用推理开放

发布方:karthikv792

热度10.3▲ 0.0
下载量 · 30天
Hugging Face
GitHub Stars
472
代码仓库
论文被引
Semantic Scholar
跑分模型 · 30天
Leaderboard results

简介

An extensible benchmark for evaluating large language models on planning