एजेंटAI सुरक्षा 🇩🇪 08.08.2026 18:02

Anthropic ने डेवलपर्स की सुरक्षा के लिए Claude Code को डिफ़ॉल्ट रूप से ऑटो-मोड में बदला

AnthropicAnthropic OpenAIOpenAI
Anthropic 14 अगस्त से Pro, Max और Team प्लान के लिए Claude Code को डिफ़ॉल्ट रूप से ऑटो-मोड में चलाएगा। यह मोड AI कोडिंग टूल को स्वायत्त रूप से काम करने देता है, जिसमें एक क्लासिफायर खतरनाक क्रियाओं की जाँच करता है। परीक्षणों से पता चलता है कि यह मैनुअल अनुमोदन जितना ही सुरक्षित है और उत्पादकता में 25% की वृद्धि करता है।
Anthropic ने घोषणा की है कि Claude Code 14 अगस्त से Pro, Max और Team प्लान के लिए डिफ़ॉल्ट रूप से ऑटो-मोड में चलेगा, जबकि Enterprise ग्राहकों को ऑप्ट-इन करना होगा। ऑटो-मोड में, यह AI कोडिंग टूल हर चरण पर मैन्युअल अनुमोदन की प्रतीक्षा किए बिना स्वतंत्र रूप से काम करता है; इसके बजाय, एक क्लासिफायर स्वचालित रूप से जाँचता है कि कोई क्रिया खतरनाक या अपरिवर्तनीय है या नहीं और केवल आवश्यक होने पर ही पुष्टि माँगता है। Anthropic के अनुसार, 1,053 भुगतान करने वाले परीक्षकों और आंतरिक रेड-टीमिंग के साथ किए गए परीक्षणों से पता चला कि ऑटो-मोड मैन्युअल अनुमोदन के समान या उससे अधिक सुरक्षित है, और ऑटो-मोड का उपयोग करने वाली टीमें लगभग 25% अधिक पुल रिक्वेस्ट बनाती हैं। Anthropic यह भी उजागर करता है कि ऑटो-मोड प्रॉम्प्ट-इंजेक्शन हमलों के खिलाफ सुरक्षा की एक अतिरिक्त परत प्रदान करता है, जहाँ इंजेक्ट किया गया कोड एजेंट को उपयोगकर्ता के निर्देशों से भटकाने की कोशिश करता है। Trajectory Labs द्वारा किए गए एक स्वतंत्र समीक्षा में ऐसे 72 हमले परिदृশ्यों का दस-दस बार परीक्षण किया गया, और Claude के वर्तमान मॉडल (Fable 5, Opus 5, Sonnet 5) के खिलाफ ऑटो-मोड में 720 हमलों में से कोई भी सफल नहीं हुआ, जबकि OpenAI के GPT-5.6 Sol के Codex ऑटो-रिव्यू मोड में 5.83% हमले सफल रहे। आंतरिक रूप से, ऑटो-मोड ने Claude को एक सार्वजनिक पेज पर गोपनीय डेटा अपलोड करने से और एक लंबे सत्र में लगभग 2,000 प्रोसेस को समाप्त करने से रोका, जिससे चल रहे GPU ट्रेनिंग जॉब नष्ट हो सकते थे। Anthropic क्लासिफायर द्वारा उपभोग किए गए टोकन के लिए शुल्क नहीं लेता है, लेकिन ऑटो-मोड का डिफ़ॉल्ट होना कंपनी के लिए आर्थिक रूप से आकर्षक होने की संभावना है क्योंकि यह समग्र टोकन उपयोग और राजस्व बढ़ाता है। Claude Code वर्तमान में सबसे व्यापक रूप से उपयोग किया जाने वाला AI कोडिंग टूल है, और यह बदलाव डेवलपर की भूमिका को सक्रिय कोडिंग से AI-जनित आउटपुट की निगरानी की ओर स्थानांतरित करता है। Anthropic प्रोडक्शन-क्रिटिकल इंफ्रास्ट्रक्चर के साथ सावधानी बरतने की सलाह देता है, यह ध्यान देते हुए कि क्लासिफायर जोखिम को कम करता है लेकिन समाप्त नहीं करता है, जो एक विरोधाभास पैदा करता है: डेवलपर्स जितना कम हस्तक्षेप करते हैं, उनका नियंत्रण उतना ही महत्वपूर्ण हो जाता है, जबकि काफी हद तक स्वायत्त रूप से बनाई गई परियोजनाओं को समझना कठिन हो जाता है।
स्रोत: The Decoder (DE) — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार