كتلة الاستدلال المشفرة في كلود: نظرة على مستوى البايت داخل التوقيع
Anthropic
تفحص مقالة على هابر الكتل المشفرة للاستدلال في نماذج كلود، وتكشف أن حقل 'التوقيع' هو بروتوبوف يسرب بيانات وصفية مثل معرف النموذج والمعرف الفريد للمنظمة كنص عادي. يوضح المؤلف أن الاستدلال الفعلي مشفر باستخدام تشفير AES-GCM، ولكن يمكن استنتاج طوله، وتشكل البيانات الوصفية خطرًا على الخصوصية إذا تم مشاركة السجلات.
مقال جديد على Habr يشرح بالتفصيل كيفية استخراج سلاسل الاستدلال المخفية من النماذج المغلقة عبر استغلال ثغرة: يأخذ المهاجم كتلة مشفرة من نموذج قوي، ويمررها إلى نموذج شقيق أضعف من نفس المزود، ويطلب إعادة سرد حرفية، وبالتالي قراءة الأفكار الأصلية، بما في ذلك أي كلمات مرور أو مفاتيح قد تكون مُدرجة بالصدفة. يكشف المؤلف أن حقل 'التوقيع' المرفق بكل كتلة تفكير في كلود ليس معتمًا: فهو بروتوبوف (protobuf) يمكن تحليله دون أي مفاتيح. في الداخل، النص الفعلي للتفكير هو الوحيد المشفر (باستخدام AES-GCM، مع وسم بحجم 16 بايت)، بينما يحتوي الغلاف الخارجي والترويسة على بيانات وصفية بنص واضح. تتضمن الترويسة معرف النموذج (مثل 'claude-opus-5')، ونوع الكتلة، ومنذ الإصدار 15 (يوليو 2026)، معرّف المؤسسة (UUID) من ملف ~/.claude.json الخاص بالمستخدم. هذه البيانات الوصفية مغطاة برمز مصادقة (MAC)، لذا لا يمكن العبث بالكتل، ولكن إذا تم كشفها في السجلات، يمكنها ربط المستخدم بمؤسسته واستخدامه للنموذج. يقترح المؤلف أن الثغرة الموصوفة في preprint قد يتم تخفيفها بوجود هذه البيانات الوصفية، لكن الخطر العملي هو أن الترويسة غير المشفرة تسرب معلومات حساسة عندما تتم مشاركة سجلات الوكلاء.
المصدر: Habr — хаб ИИ —
الأصلي
