क्लॉड कोड में प्रो, मैक्स और टीम प्लान के लिए ऑटो मोड डिफ़ॉल्ट बन गया
Anthropic
एंथ्रोपिक 14 अगस्त से अधिकांश योजनाओं में नए सत्रों के लिए क्लॉड कोड के ऑटो मोड को डिफ़ॉल्ट बना रहा है। कंपनी व्यापक सुरक्षा सुधारों का दावा करती है, जो मूल्यांकनों द्वारा समर्थित है, जिसमें ऑटो मोड 89% हानिकारक कार्यों को रोकता है जिन्हें मनुष्य अक्सर अनुमोदित करते हैं। हालाँकि, स्वतंत्र सत्यापन अभी भी आवश्यक है, विशेष रूप से अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन हमलों के लिए।
Anthropic को Claude Code के ऑटो मोड पर पूरा भरोसा है, और इसे 14 अगस्त, 2026 से Pro, Max और Team योजनाओं में नए सत्रों के लिए डिफ़ॉल्ट बना रहा है। AI Engineer World's Fair में एक Fireside Chat के दौरान, Cat Wu और Thariq Shihipar ने चर्चा की कि Anthropic Claude Code को सुरक्षित रूप से कैसे चलाता है, और बताया कि आंतरिक रूप से लगभग सभी लोग ऑटो मोड का उपयोग करते हैं और उन्होंने प्रॉम्प्ट इंजेक्शन और डेटा बहिर्गमन जैसे प्रमुख जोखिमों को कम किया है। Anthropic ने 1,053 भुगतान किए गए परीक्षकों के साथ एक परीक्षण से मूल्यांकन प्रकाशित किया, जहां एक खतरनाक कमांड को एक सत्र में बदल दिया गया था; केवल 13.6% मनुष्यों ने मना कर दिया, जबकि ऑटो मोड ने उन कार्यों में से 89% को रोक दिया होता। Anthropic ने Trajectory Labs से एक मूल्यांकन भी करवाया, जिसने Claude Code और Codex के खिलाफ 72 अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन परिदृश्यों का परीक्षण किया, और ऑटो मोड में Claude Fable 5, Opus 5 या Sonnet 5 के खिलाफ शून्य सफल हमले पाए। लेखक, Simon Willison, स्वीकार करते हैं कि ऑटो मोड पुष्टि थकान के कारण मानव अनुमोदन से बेहतर हो सकता है, लेकिन वह दुर्भावनापूर्ण पैकेजों के माध्यम से अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन के बारे में चिंतित हैं, जैसे कि एक परीक्षण निर्देश जो डेटा बहिर्गमन के लिए एक दुर्भावनापूर्ण उपकरण चलाता है। वह स्वतंत्र पुष्टि की मांग करते हैं और सुझाव देते हैं कि एजेंटों को प्रतिबंधित डेटा और उपकरण पहुंच के साथ चलाया जाए।
स्रोत: Simon Willison —
मूल
