BenchMark·Hub

BFCL (Berkeley Function Calling)

S高可信Benchmark
智能体工具调用BFCL 家族未知

发布方:UC Berkeley

热度8.9▼ 0.6

overall

bfcl / accuracy · 109 行结果

排名模型子项分数Metric时间
#1Claude-Opus-4-5-20251101 (FC)
Anthropic
overall
bfcl
77.5%accuracy2026-08-28
#2Claude-Sonnet-4-5-20250929 (FC)
Anthropic
overall
bfcl
73.2%accuracy2026-08-28
#3Gemini-3-Pro-Preview (Prompt)
Google
overall
bfcl
72.5%accuracy2026-08-28
#4GLM-4.6 (FC thinking)
Zhipu AI
overall
bfcl
72.4%accuracy2026-08-28
#5Grok-4-1-fast-reasoning (FC)
xAI
overall
bfcl
69.6%accuracy2026-08-28
#6Claude-Haiku-4-5-20251001 (FC)
Anthropic
overall
bfcl
68.7%accuracy2026-08-28
#7Gemini-3-Pro-Preview (FC)
Google
overall
bfcl
68.1%accuracy2026-08-28
#8o3-2025-04-16 (Prompt)
OpenAI
overall
bfcl
63.1%accuracy2026-08-28
#9Grok-4-0709 (Prompt)
xAI
overall
bfcl
63%accuracy2026-08-28
#10Grok-4-0709 (FC)
xAI
overall
bfcl
61.4%accuracy2026-08-28
#11Moonshotai-Kimi-K2-Instruct (FC)
MoonshotAI
overall
bfcl
59.1%accuracy2026-08-28
#12Grok-4-1-fast-non-reasoning (FC)
xAI
overall
bfcl
58.3%accuracy2026-08-28
#13Command A Reasoning (FC)
Cohere
overall
bfcl
57.1%accuracy2026-08-28
#14DeepSeek-V3.2-Exp (Prompt + Thinking)
DeepSeek
overall
bfcl
56.7%accuracy2026-08-28
#15Gemini-2.5-Flash (FC)
Google
overall
bfcl
56.2%accuracy2026-08-28
#16GPT-5.2-2025-12-11 (FC)
OpenAI
overall
bfcl
55.9%accuracy2026-08-28
#17GPT-5-mini-2025-08-07 (FC)
OpenAI
overall
bfcl
55.5%accuracy2026-08-28
#18xLAM-2-32b-fc-r (FC)
Salesforce
overall
bfcl
54.7%accuracy2026-08-28
#19DeepSeek-V3.2-Exp (FC)
DeepSeek
overall
bfcl
54.1%accuracy2026-08-28
#20GPT-4.1-2025-04-14 (FC)
OpenAI
overall
bfcl
54%accuracy2026-08-28
#21o4-mini-2025-04-16 (FC)
OpenAI
overall
bfcl
53.2%accuracy2026-08-28
#22xLAM-2-70b-fc-r (FC)
Salesforce
overall
bfcl
53.1%accuracy2026-08-28
#23Qwen3-235B-A22B-Instruct-2507 (Prompt)
Qwen
overall
bfcl
52.2%accuracy2026-08-28
#24GPT-5-nano-2025-08-07 (FC)
OpenAI
overall
bfcl
51.5%accuracy2026-08-28
#25Nanbeige4-3B-Thinking-2511 (FC)
Nanbeige
overall
bfcl
51.4%accuracy2026-08-28
109 条结果 · 当前 1-25
1 / 5