AI सुरक्षाएजेंट 🇨🇳 10.08.2026 09:01

क्लॉड कोड अब 5 दिनों में डिफ़ॉल्ट रूप से ऑटो मोड में स्विच होगा, एंथ्रोपिक अतिरिक्त लागत वहन करेगा

AnthropicAnthropic OpenAIOpenAI
एंथ्रोपिक पांच दिनों में क्लॉड कोड के लिए ऑटो मोड को डिफ़ॉल्ट बना देगा, जिसका कारण मैन्युअल अनुमति स्वीकृति की कम अस्वीकृति दर और क्लासिफायर का बेहतर सुरक्षा प्रदर्शन है। ऑटो मोड में प्रति टूल कॉल की अतिरिक्त टोकन लागत उपयोगकर्ताओं से नहीं ली जाएगी। अमेज़न, गूगल और माइक्रोसॉफ्ट जैसे क्लाउड प्लेटफॉर्म के पास डिफ़ॉल्ट रूप से ऑटो मोड में स्विच करने के लिए एक महीने का समय है।
एंथ्रोपिक पांच दिनों में सभी क्लॉड कोड इंस्टॉलेशन के लिए डिफ़ॉल्ट रूप से ऑटो मोड सक्षम करेगा, ऐसा पता चलने के बाद कि उपयोगकर्ताओं द्वारा केवल 3% अनुमति अनुरोध अस्वीकार किए जाते हैं। ऑटो मोड क्लासिफायर प्रति टूल कॉल में कुछ अतिरिक्त टोकन की खपत करता है, लेकिन एंथ्रोपिक यह लागत उपयोगकर्ताओं पर नहीं डालेगा। अमेज़न, गूगल और माइक्रोसॉफ्ट जैसे क्लाउड प्लेटफ़ॉर्म, जो वर्तमान में एक विकल्प के रूप में ऑटो मोड प्रदान करते हैं, उन्हें एक महीने के भीतर डिफ़ॉल्ट ऑटो मोड पर स्विच करना होगा। 'क्लॉड कोड के जनक' के अनुसार, एंथ्रोपिक की आंतरिक टीम पहले से ही विशेष रूप से ऑटो मोड का उपयोग करती है। एंथ्रोपिक इस बदलाव को डेटा के साथ उचित ठहराता है: मैन्युअल अनुमोदन आदतन हो गया है, अनुमति संकेतों के लिए 97% स्वीकृति दर के साथ, जबकि एकल अनुमति अनुरोधों के लिए अस्वीकृति दर केवल 3% है। 1053 भुगतान किए गए परीक्षकों के साथ एक नियंत्रित प्रयोग में, मानव प्रतिभागियों ने स्पष्ट रूप से खतरनाक कमांड को 13.6% समय में रोका, जबकि ऑटो मोड ने इसे 89% समय में रोका; ऑटो मोड ने 800 कमांड को ब्लॉक किया जिन्हें मनुष्यों ने अनुमति दी, जबकि मनुष्यों ने केवल 6 कमांड को ब्लॉक किया जिन्हें ऑटो मोड ने अनुमति दी। मानव प्रदर्शन सत्र की लंबाई के साथ घट गया, शुरुआत में लगभग 17% से घटकर 50 संकेतों के बाद लगभग 5% हो गया, जबकि ऑटो मोड की अवरोधन दर स्थिर रही। गंभीरता पैमाने 0 से 10 पर पुनः स्कोर किए गए उत्पादन डेटा से पता चला कि गंभीरता 7 और उससे ऊपर पर, मैन्युअल रूप से अनुमोदित सत्रों के 6.3% में उपयोगकर्ता द्वारा स्पष्ट रूप से अनुरोध नहीं किए गए हानिकारक कार्य शामिल थे, जबकि ऑटो मोड के लिए यह 2.4% था। क्लासिफायर का एपोलो रिसर्च के साथ प्रतिकूल परीक्षण किया गया, जिसने वास्तविक कोडिंग ट्रेस में सिंथेटिक हमले इंजेक्ट किए; सख्त करने के बाद, ऑटो मोड ने पहले से छूटे लगभग आधे हमलों को पुनर्प्राप्त किया, संयुक्त डेटासेट पर मिस दर 12% से घटकर 7% हो गई। ट्रैजेक्टरी लैब्स द्वारा प्रॉम्प्ट इंजेक्शन परीक्षणों में, क्लॉड फेबल 5, ओपस 5 और सोनेट 5 ऑटो मोड चलाने वाले 720 प्रयासों में समझौता नहीं किए गए, जबकि कोडेक्स ऑटो-रिव्यू मोड में जीपीटी-5.6 सोल की सफलता दर 5.83% और फुल एक्सेस मोड में 19.03% थी। तीन सार्वजनिक अवरोधन मामलों में एक सार्वजनिक कोड-साझाकरण साइट पर एक रिपोर्ट प्रकाशित करने की योजना को रोकना, 2000 पॉड्स में प्रक्रियाओं के बल्क समाप्ति को रोकना, और पूर्ण व्यवस्थापक अनुमतियों वाली क्लाउड भूमिका को ध्वजांकित करना शामिल है। नई क्षमताओं में डेटा निष्कासन का कठोर खंडन, कुंजी और संवेदनशील जानकारी तक पहुंच का अंतर, जैसे कमांड से पहले गिट स्थिति की जांच करना गिट रीसेट --हार्ड, और इंजेक्शन प्रयासों के लिए एपीआई-साइड प्रोबिंग शामिल है। उपयोगकर्ता सीएलआई में शिफ्ट+टैब या डेस्कटॉप पर मोड ड्रॉपडाउन के साथ मोड स्विच कर सकते हैं; व्यवस्थापक संगठन-व्यापी डिफ़ॉल्ट सेट कर सकते हैं या ऑटो मोड को पूरी तरह से अक्षम कर सकते हैं। एंथ्रोपिक नोट करता है कि ऑटो मोड जोखिम को कम करता है लेकिन समाप्त नहीं करता है, और उच्च-जोखिम वाले परिवर्तनों की समीक्षा करने की सिफारिश करता है।
स्रोत: QbitAI 量子位 — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार