El agente Baidu ERNIE encabeza la clasificación del renombrado benchmark de modelos de lenguaje grandes PinchBench v2
Baidu
El modelo agente ERNIE de Baidu encabezó la clasificación de PinchBench v2, superando a GPT-4 y otros modelos. Este logro subraya el liderazgo de Baidu en agentes de inteligencia artificial.
El modelo-agente ERNIE de Baidu (文心助手任务Agent) ha alcanzado el primer puesto en la clasificación del popular benchmark para grandes modelos de lenguaje PinchBench v2. Este resultado demuestra un progreso significativo de Baidu en el ámbito de los agentes de inteligencia artificial, que permiten realizar tareas complejas. Durante las pruebas, el modelo superó a competidores, incluido GPT-4 de OpenAI. PinchBench v2 es un test de referencia que evalúa la capacidad de los modelos para resolver tareas mediante el uso de herramientas y planificación.
Fuente: Baidu ERNIE (GNews) —
original
