An toàn AIQuy định 🇺🇸 09.08.2026 18:02

Anthropic thêm cổng chặn trước mỗi lời nhắc của Claude

AnthropicAnthropic
Theo một bản cập nhật gần đây, Anthropic đã triển khai một cổng chặn (deny gate) để can thiệp vào mọi lời nhắc gửi đến Claude. Cổng chặn này được thiết kế để lọc hoặc chặn một số yêu cầu nhất định trước khi chúng đến được mô hình.
Trong một diễn biến mới đây từ Anthropic, công ty này đã giới thiệu một "cổng từ chối" (deny gate) đặt trước mọi câu lệnh (prompt) gửi đến Claude. Cổng này đóng vai trò như một bộ lọc sơ bộ, nhiều khả năng nhằm thực thi các quy định về an toàn hoặc chính sách, từ chối một số câu lệnh nhất định trước khi chúng được mô hình AI xử lý. Bản chất chính xác của bộ lọc này cũng như các tiêu chí áp dụng chưa được nêu chi tiết trong bản tin gốc, nhưng đây được xem là một thay đổi đáng kể trong cách xử lý đầu vào. Động thái này có thể ảnh hưởng đến những người dùng phụ thuộc vào Claude cho nhiều tác vụ khác nhau, và có nguy cơ chặn nhầm một số yêu cầu hợp lệ. Thông báo này được đưa ra qua bản tin có tên Pondero Brief vào ngày 6 tháng 8 năm 2026.
Nguồn: xAI Grok (GNews) — bản gốc
Bài viết liên quan trước đây ↓
Tin mới