Mode Otomatis Menjadi Default di Claude Code untuk Paket Pro, Max, dan Tim
Anthropic
Anthropic menjadikan mode otomatis Claude Code sebagai default untuk sesi baru di sebagian besar paket mulai 14 Agustus. Perusahaan mengklaim peningkatan keamanan yang ekstensif, didukung oleh evaluasi yang menunjukkan mode otomatis memblokir 89% tindakan berbahaya yang sering disetujui manusia. Namun, verifikasi independen masih diperlukan, terutama untuk serangan injeksi prompt tidak langsung.
Anthropic yakin dengan mode otomatis Claude Code, sehingga menjadikannya default untuk sesi baru pada paket Pro, Max, dan Tim mulai 14 Agustus 2026. Dalam Fireside Chat di AI Engineer World's Fair, Cat Wu dan Thariq Shihipar membahas bagaimana Anthropic menjalankan Claude Code dengan aman, mencatat bahwa hampir semua orang secara internal menggunakan mode otomatis dan mereka telah memitigasi risiko besar seperti injeksi prompt dan eksfiltrasi data. Anthropic menerbitkan evaluasi dari tes dengan 1.053 penguji berbayar di mana perintah berbahaya disisipkan ke dalam sesi; hanya 13,6% manusia yang menolak, sementara mode otomatis akan memblokir 89% dari tindakan tersebut. Anthropic juga menugaskan evaluasi dari Trajectory Labs, yang menguji 72 skenario injeksi prompt tidak langsung terhadap Claude Code dan Codex, menemukan nol serangan berhasil terhadap Claude Fable 5, Opus 5, atau Sonnet 5 dalam mode otomatis. Penulis, Simon Willison, mengakui bahwa mode otomatis mungkin lebih baik daripada persetujuan manusia karena kelelahan konfirmasi, tetapi ia khawatir tentang injeksi prompt tidak langsung melalui paket berbahaya, seperti instruksi tes yang menjalankan alat berbahaya untuk mengeksfiltrasi data. Ia menyerukan konfirmasi independen dan menyarankan menjalankan agen dengan akses data dan alat yang dibatasi.
Sumber: Simon Willison —
asli
