Señal del modelo para llamadas a herramientas · Berkeley Function-Calling Leaderboard
BFCL V4 · Grok-4-1-fast-reasoning (FC)
Este resultado de BFCL describe un modelo y una configuración de llamadas a funciones, no un producto Agent completo ni un resultado sobre su idoneidad para producción.
01
Configuración
02
Resultado
03
Operación
04
Confianza
Nota sobre la evidencia
Incluye las 109 filas del editor procedentes de un único CSV V4 fijado. Todas comparten el commit f7cf735, bfcl-eval 2025.12.17 y la misma composición de la precisión general.
Abrir auditoría ↗Qué no demuestra este resultado
Este resultado de BFCL describe un modelo y una configuración de llamadas a funciones, no un producto Agent completo ni un resultado sobre su idoneidad para producción.
Datos comunicados por la fuente; los valores ausentes siguen siendo desconocidos.
Validar antes de adoptar
Las clasificaciones públicas permiten elaborar una lista de finalistas. Una pequeña prueba privada determina si la configuración se adapta a tu trabajo.
- 1
Elige entre 10 y 20 tareas representativas y define una condición de aprobación clara.
- 2
Fija el agente, el modelo, las herramientas, los permisos y el presupuesto antes de realizar la prueba.
- 3
Ejecute cada tarea importante más de una vez; registre el éxito, el coste, el tiempo y las intervenciones humanas.
- 4
Revise los fallos y los riesgos del tratamiento de datos antes de tomar una decisión de producción.