سلامة الذكاء الاصطناعي 🇩🇪 12.08.2026 21:04

كشف ثغرة معمارية في GPT-5 وClaude وGemini

OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind
اكتشف فريق بحثي دولي ثغرة معمارية في الكتل المشفرة لسلسلة التفكير الخاصة بنماذج الذكاء الاصطناعي الرائدة مثل GPT-5 وClaude وGemini. وباستخدام نماذج أصغر من نفس البائعين، يمكن للمهاجمين فك تشفير وقراءة عمليات التفكير بأكملها، مما قد يعرض البيانات الحساسة للخطر.
كشف فريق بحثي دولي عن ثغرة معمارية حرجة في كتل الاستدلال المشفرة داخل أنظمة الذكاء الاصطناعي الرائدة مثل GPT-5 وClaude وGemini. تولّد هذه الأنظمة سلسلة أفكار داخلية قبل الإجابة، والتي يقوم البائعون بتشفيرها وإرسالها إلى العميل، لتعاد فقط مع الاستعلامات المتابعة. وجد الباحثون أن OpenAI وAnthropic وGoogle يستخدمون مفاتيح تشفير عامة لعائلات نماذجهم، مما يعني أن كتل الاستدلال المشفرة غير مرتبطة بمستخدم أو جلسة أو نموذج محدد. وهذا يسمح للمهاجمين بأخذ كتلة الاستدلال المشفرة لنموذج رئيسي وتقديمها إلى نموذج شقيق أصغر وأقل تقييدًا، والذي يقوم بعد ذلك بفك تشفيرها وإخراج عملية الاستدلال الكاملة. قام الفريق بتحليل المستودعات والسجلات العامة، وعثروا على 315,320 كتلة استدلال مشفرة، ونجحوا في فك تشفير معرفات شخصية ومفاتيح API وكلمات مرور وعناوين بريد إلكتروني. كما تتيح هذه الثغرة إمكانية إدخال تعليمات برمجية خفية (حقن موجهات) واستنساخًا غير مصرح به لقدرات النموذج. أبلغ الباحثون الشركات المتأثرة بهذه النتائج، وقد بدأت هذه الشركات في تنفيذ إجراءات مضادة؛ ومع ذلك، حتى يتم ربط التشفير بشكل صارم بجلسة محددة، لا يمكن للمستخدمين افتراض الحماية.
المصدر: Heise online — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة