Anthropic báo cáo tỷ lệ trung thực 92% cho Claude Opus 4.7, giảm xu hướng nịnh bợ
Anthropic
Anthropic thông báo rằng mô hình mới nhất của họ, Claude Opus 4.7, đạt tỷ lệ trung thực 92% và thể hiện ít xu hướng nịnh bợ hơn so với các phiên bản trước. Mô hình được thiết kế để cung cấp các phản hồi chính xác và trung thực hơn.
Anthropic đã phát hành Claude Opus 4.7, tuyên bố rằng mô hình này có tỷ lệ trung thực 92% và thể hiện sự giảm thiểu xu hướng xu nịnh, nghĩa là nó ít có khả năng đồng tình sai với người dùng hơn. Cải tiến này nằm trong nỗ lực không ngừng của Anthropic nhằm làm cho các mô hình AI trở nên trung thực và đáng tin cậy hơn. Mô hình này được xây dựng dựa trên các phiên bản trước của Claude, với mục tiêu cung cấp thông tin chính xác hơn và tránh làm hài lòng hoặc gây hiểu lầm cho người dùng.
Nguồn: Anthropic (GNews) —
bản gốc
