BFCL-v3 (Berkeley Function Calling Leaderboard v3) benchmark for function calling capabilities

表格 2 results
NameCategoriesTopicsReferencesCredibilityCreateDateUpdateDateTitleNavigationOrderEleventyTemplateEngineOverrideCreatedRelatedNotes
20260423_agentevolver_self_evolving_agentpaper_analysisagent_architecture, reinforce_learning, llm, reasoningtongyi_lab, appworld, bfcl_v3100AgentEvolver: Towards Efficient Self-Evolving Agent System[object Object][object Object]md
20260611_trace_unified_rollout_budget_allocation_agentic_rlpaper_analysisreinforce_learning, reasoning, agent_architecture, test_time_scaling, llmtsinghua_university, hotpotqa, bfcl_v3, monte_carlo_tree_search100TRACE: A Unified Rollout Budget Allocation Framework for Efficient Agentic Reinforcement Learning[object Object][object Object]mdrl_long_horizon_reasoning_llm_expressiveness, agent_memory_and_reasoning_frontier_survey_2026
Powered by Forestry.md