Các Thẩm Phán Pakistan Đưa Ra Phán Quyết Về JudgeGPT
OpenAI
Một thử nghiệm quy mô lớn tại Pakistan đã phát hiện rằng công cụ AI tùy chỉnh dành cho thẩm phán, kết hợp với đào tạo, đã tăng tỷ lệ giải quyết vụ án lên 6,3% mà không làm giảm chất lượng phán quyết. Công cụ này, được xây dựng trên GPT-4 của OpenAI và dữ liệu pháp lý Pakistan, đã được hơn 1.500 thẩm phán sử dụng.
Tại Pakistan, một thử nghiệm với sự tham gia của 1.559 thẩm phán đã thử nghiệm một công cụ trí tuệ nhân tạo (AI) tùy chỉnh mang tên JudgeGPT, kết hợp mô hình GPT-4 của OpenAI với cơ sở dữ liệu gồm 128.292 bản án và 943 văn bản luật. Công cụ này hỗ trợ các thẩm phán trong việc nghiên cứu pháp lý và soạn thảo văn bản, giúp số vụ án được giải quyết tại mỗi quận tăng 6,3%, trong khi chất lượng phán quyết không hề suy giảm. Nghiên cứu do nhà kinh tế học Sultan Mehmood dẫn đầu cũng triển khai đào tạo cho một số thẩm phán, và điều này tỏ ra mang tính quyết định: những thẩm phán được đào tạo chuyên sâu về JudgeGPT đã đăng nhập trung bình 56 lần và gửi 212 câu lệnh (prompt), so với chỉ 10 lần đăng nhập và 25 câu lệnh ở nhóm chỉ nhận đào tạo chung chung, còn nhóm không được đào tạo thì thường bỏ dở công cụ. Các nhà nghiên cứu đã sử dụng kỹ thuật tạo sinh tăng cường truy xuất (retrieval-augmented generation) để giảm thiểu hiện tượng "ảo giác" của AI, đồng thờari đánh giá chất lượng bản án bằng cách cho mô hình GPT-5-mini của OpenAI so sánh các phán quyết trước và sau đào tạo — kết quả cho thấy các luật sư giàu kinh nghiệm đồng ý với đánh giá của mô hình trong 70,6% trường hợp. Mặc dù công cụ này giúp thẩm phán tiết kiệm thờari gian, vẫn còn những lo ngại về chất lượng công lý cũng như rủi ro phụ thuộc quá mức vào AI.
Nguồn: IEEE Spectrum AI —
bản gốc
