AI सुरक्षा 🇷🇺 11.08.2026 22:01

क्लॉड का एन्क्रिप्टेड रीज़निंग ब्लॉक: सिग्नेचर के अंदर एक बाइट-स्तरीय नज़र

AnthropicAnthropic
हैबआर लेख क्लॉड मॉडल्स के एन्क्रिप्टेड रीज़निंग ब्लॉक्स की जांच करता है, और बताता है कि 'सिग्नेचर' फील्ड एक प्रोटोबफ है जो मेटाडेटा जैसे कि मॉडल आईडी और संगठन यूयूआईडी को प्लेनटेक्स्ट में लीक करता है। लेखक दिखाता है कि वास्तविक रीज़निंग एईएस-जीसीएम से एन्क्रिप्टेड है, लेकिन इसकी लंबाई अनुमानित की जा सकती है, और यदि लॉग साझा किए जाते हैं तो मेटाडेटा गोपनीयता जोखिम पैदा करता है।
हैबर पर एक नया लेख बताता है कि कैसे बंद मॉडलों से छिपी हुई तर्क श्रृंखलाओं को एक कमजोरी का फायदा उठाकर निकाला जा सकता है: एक हमलावर एक मजबूत मॉडल से एक एन्क्रिप्टेड ब्लॉक लेता है, उसे उसी प्रदाता के एक कमजोर सहयोगी मॉडल को देता है, और शब्दशः पुनर्कथन मांगता है, इस प्रकार मूल विचारों को पढ़ता है, जिसमें गलती से शामिल पासवर्ड या कुंजियाँ भी शामिल हैं। लेखक बताता है कि हर क्लॉड थिंकिंग ब्लॉक से जुड़ा 'सिग्नेचर' फ़ील्ड अपारदर्शी नहीं है: यह एक प्रोटोबफ है जिसे बिना किसी कुंजी के पार्स किया जा सकता है। अंदर, केवल वास्तविक विचार पाठ एन्क्रिप्टेड है (एईएस-जीसीएम, 16-बाइट टैग के साथ), जबकि बाहरी आवरण और हेडर में मेटाडेटा प्लेनटेक्स्ट में होता है। हेडर में मॉडल आईडी (जैसे, 'क्लॉड-ओपस-5'), ब्लॉक प्रकार, और संस्करण 15 (जुलाई 2026) के बाद से, उपयोगकर्ता के ~/.claude.json से संगठन यूयूआईडी शामिल है। यह मेटाडेटा एक मैक द्वारा कवर किया गया है, इसलिए ब्लॉकों के साथ छेड़छाड़ नहीं की जा सकती है, लेकिन यदि लॉग में उजागर किया जाता है, तो यह किसी उपयोगकर्ता को उनके संगठन और मॉडल उपयोग से जोड़ सकता है। लेखक सुझाव देता है कि प्रीप्रिंट में वर्णित कमजोरी इस मेटाडेटा की उपस्थिति से कम हो सकती है, लेकिन व्यावहारिक जोखिम यह है कि जब एजेंट लॉग साझा किए जाते हैं तो अनएन्क्रिप्टेड हेडर संवेदनशील जानकारी लीक करता है।
स्रोत: Habr — хаб ИИ — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार