El agente ERNIE de Baidu lidera el benchmark PinchBench v2
Baidu
El agente ERNIE de Baidu alcanzó el primer lugar en el conocido benchmark de modelos de lenguaje grande PinchBench v2, demostrando un rendimiento superior en tareas de agente.
El modelo ERNIE Agent de Baidu ha encabezado la tabla de clasificación de PinchBench v2, un importante punto de referencia para evaluar modelos de lenguaje grandes. Este punto de referencia evalúa las capacidades de los agentes, incluyendo la planificación, el uso de herramientas y el razonamiento en múltiples pasos. ERNIE Agent superó a otros modelos, demostrando la fortaleza de Baidu en el desarrollo de agentes de inteligencia artificial.
Fuente: Baidu ERNIE (GNews) —
original
