百度文心智能体在知名大语言模型基准测试PinchBench v2中位居榜首
Baidu
百度文心智能体模型在PinchBench v2排名中高居榜首,超越了GPT-4等其他模型。这一成就彰显了百度在AI智能体领域的领先地位。
百度ERNIE模型(文心助手任务Agent)在热门大语言模型基准测试PinchBench v2中拔得头筹。这一结果展示了百度在人工智能代理(AI agent)领域取得的重大进展,该代理能够执行复杂任务。在测试过程中,该模型超越了包括OpenAI的GPT-4在内的竞争对手。PinchBench v2是一个基准测试,用于评估模型运用工具和规划能力来解决问题的能力。
来源: Baidu ERNIE (GNews) —
原文
