LLMs-Planning
B待确认Benchmark推理通用推理开放
发布方:karthikv792
热度10.3▲ 0.0
下载量 · 30天
—
Hugging Face
GitHub Stars
472
代码仓库
论文被引
—
Semantic Scholar
跑分模型 · 30天
—
Leaderboard results
简介
An extensible benchmark for evaluating large language models on planning
发布方:karthikv792
An extensible benchmark for evaluating large language models on planning