Jueces paquistaníes dan su veredicto sobre JudgeGPT
OpenAI
Un ensayo a gran escala en Pakistán reveló que una herramienta de inteligencia artificial personalizada para jueces, combinada con capacitación, aumentó la resolución de casos en un 6,3% sin reducir la calidad de las decisiones. La herramienta, construida sobre el GPT-4 de OpenAI y datos legales paquistaníes, fue utilizada por más de 1.500 jueces.
En Pakistán, un ensayo en el que participaron 1.559 jueces probó una herramienta de inteligencia artificial personalizada llamada JudgeGPT, que combina el GPT-4 de OpenAI con una base de datos de 128.292 opiniones judiciales y 943 estatutos. La herramienta ayudó a los jueces con la investigación jurídica y la redacción de documentos, lo que condujo a un aumento del 6,3 % en los casos resueltos por distrito, sin una caída correspondiente en la calidad de las decisiones. El estudio, dirigido por el economista Sultan Mehmood, también proporcionó formación a algunos jueces, lo que resultó crucial: los jueces que recibieron formación específica sobre JudgeGPT iniciaron sesión 56 veces y enviaron un promedio de 212 instrucciones, en comparación con los 10 inicios de sesión y 25 instrucciones de aquellos con formación genérica, y los que no recibieron formación a menudo abandonaron la herramienta. Los investigadores utilizaron generación aumentada por recuperación para reducir las alucinaciones, y evaluaron la calidad de las decisiones haciendo que el GPT-5-mini de OpenAI comparara sentencias previas y posteriores a la formación, con abogados experimentados que coincidieron con el modelo el 70,6 % de las veces. Si bien la herramienta ahorró tiempo a los jueces, persisten algunas preocupaciones sobre la calidad de la justicia y el riesgo de una dependencia excesiva de la IA.
Fuente: IEEE Spectrum AI —
original
