Claude Code chuyển sang chế độ tự động mặc định sau 5 ngày, Anthropic chi trả chi phí phát sinh
Anthropic
OpenAI
Anthropic sẽ đưa chế độ tự động trở thành mặc định cho Claude Code trong vòng năm ngày, với lý do tỷ lệ từ chối phê duyệt thủ công thấp và hiệu suất an toàn của bộ phân loại tốt hơn. Chi phí token bổ sung cho mỗi lần gọi công cụ ở chế độ tự động sẽ không được tính cho người dùng. Các nền tảng đám mây như Amazon, Google và Microsoft có một tháng để chuyển sang chế độ tự động mặc định.
Anthropic sẽ bật chế độ tự động theo mặc định cho tất cả các bản cài đặt Claude Code trong vòng năm ngày tới, sau khi nhận thấy chỉ có 3% yêu cầu cấp quyền bị người dùng từ chối. Bộ phân loại chế độ tự động tiêu tốn một số lượng nhỏ token bổ sung cho mỗi lần gọi công cụ, nhưng Anthropic sẽ không chuyển chi phí này cho người dùng. Các nền tảng đám mây như Amazon, Google và Microsoft, hiện cung cấp chế độ tự động như một tùy chọn, phải chuyển sang chế độ tự động mặc định trong vòng một tháng. Đội ngũ nội bộ của Anthropic đã sử dụng hoàn toàn chế độ tự động, theo 'cha đẻ của Claude Code.' Anthropic giải thích sự thay đổi này bằng dữ liệu: việc phê duyệt thủ công đã trở thành thói quen, với tỷ lệ chấp nhận 97% đối với các lời nhắc cấp quyền, trong khi tỷ lệ từ chối đối với các yêu cầu cấp quyền đơn lẻ chỉ là 3%. Trong một thử nghiệm có kiểm soát với 1053 người kiểm tra được trả phí, những người tham gia đã chặn một lệnh nguy hiểm rõ ràng 13,6% số lần, trong khi chế độ tự động chặn được 89% số lần; chế độ tự động đã chặn 800 lệnh mà con người cho phép, trong khi con người chỉ chặn 6 lệnh mà chế độ tự động cho phép. Hiệu suất của con người giảm dần theo thời lượng phiên, từ khoảng 17% ở giai đoạn đầu xuống còn khoảng 5% sau 50 lời nhắc, trong khi tỷ lệ chặn của chế độ tự động không đổi. Dữ liệu sản xuất được chấm điểm lại trên thang mức độ nghiêm trọng từ 0 đến 10 cho thấy ở mức độ nghiêm trọng từ 7 trở lên, 6,3% phiên được phê duyệt thủ công liên quan đến các hành động có hại mà người dùng không yêu cầu rõ ràng, so với 2,4% ở chế độ tự động. Bộ phân loại đã được kiểm tra đối kháng với Apollo Research, công ty đã chèn các cuộc tấn công tổng hợp vào các dấu vết mã hóa thực tế; sau khi củng cố, chế độ tự động đã phục hồi khoảng một nửa số cuộc tấn công bị bỏ lỡ trước đó, với tỷ lệ bỏ lỡ giảm từ 12% xuống 7% trên các tập dữ liệu kết hợp. Trong các bài kiểm tra chèn lời nhắc do Trajectory Labs thực hiện, Claude Fable 5, Opus 5 và Sonnet 5 chạy chế độ tự động không bị xâm phạm trong 720 lần thử, trong khi GPT-5.6 Sol trong Chế độ tự động xem xét của Codex có tỷ lệ thành công 5,83% và 19,03% trong Chế độ toàn quyền truy cập. Ba trường hợp chặn công khai bao gồm việc chặn kế hoạch xuất bản báo cáo trên một trang web chia sẻ mã công khai, chặn việc chấm dứt hàng loạt quy trình trên 2000 pod, và gắn cờ một vai trò đám mây có quyền quản trị viên đầy đủ. Các khả năng mới bao gồm từ chối cứng rắn đối với hành vi trích xuất dữ liệu, phân biệt quyền truy cập thông tin khóa và thông tin nhạy cảm, kiểm tra trạng thái git trước các lệnh như git reset --hard, và thăm dò phía API để phát hiện các nỗ lực chèn. Người dùng có thể chuyển chế độ bằng Shift+Tab trong CLI hoặc menu thả xuống chế độ trên máy tính để bàn; quản trị viên có thể đặt mặc định toàn tổ chức hoặc tắt hoàn toàn chế độ tự động. Anthropic lưu ý rằng chế độ tự động làm giảm nhưng không loại bỏ rủi ro và khuyến nghị xem xét các thay đổi có rủi ro cao.
Nguồn: QbitAI 量子位 —
bản gốc
