BenchMark
·
Hub
总览
Benchmark 库
热度榜
家族
搜索 benchmark
⌘K
总览
/
Benchmark 库
/
PawBench
PawBench
B
待确认
Benchmark
性能/成本
服务部署
开放
发布方:
agentscope-ai
热度
0.0
±0
GitHub
主页
概览
家族成员
评测结果
样本集
下载量 · 30天
—
Hugging Face
GitHub Stars
—
代码仓库
论文被引
—
Semantic Scholar
跑分模型 · 30天
—
Leaderboard results
简介
A benchmark for evaluating LLM × harness performance.