Anthropic sẽ để AI tự động xem xét các hành động của Claude Code theo mặc định
Anthropic
Anthropic dự định bật tính năng đánh giá bảo mật do AI điều khiển cho các hành động của Claude Code theo mặc định, tăng cường an toàn trước các cuộc tấn công chèn lệnh. Tính năng này, ban đầu được ra mắt dưới dạng bản beta, sẽ được tự động kích hoạt cho tất cả người dùng, với tùy chọn từ chối tham gia.
Anthropic đã thông báo rằng họ sẽ bật tính năng đánh giá bảo mật do AI điều khiển cho các hành động của Claude Code theo mặc định. Tính năng này trước đây chỉ có ở dạng beta, sẽ được tự động bật cho tất cả người dùng, mặc dù họ có thể chọn tắt đi. Thay đổi này nhằm cung cấp khả năng bảo vệ mạnh mẽ hơn chống lại các cuộc tấn công tiêm nhiễm lời nhắc (prompt injection) và các mối đe dọa bảo mật khác. Việc đánh giá bảo mật sẽ áp dụng cho các hành động được thực hiện bởi Claude Code, đảm bảo rằng các lệnh có khả năng gây hại sẽ được đánh dấu hoặc chặn lại. Động thái này phản ánh cam kết liên tục của Anthropic đối với an toàn trong các môi trường lập trình có hỗ trợ AI.
Nguồn: Anthropic (GNews) —
bản gốc
