كلود.رو تفتح مصدر حماية Guardrails Filter لحماية البيانات عند العمل مع نماذج اللغة الكبيرة
Cloud.ru
أصدرت Cloud.ru أداة Guardrails Filter كمصدر مفتوح، وهي وكيل عكسي يخفي البيانات الحساسة في الطلبات المقدمة إلى نماذج اللغة ويستعيدها في الردود. تدعم الأداة البيانات الشخصية الروسية، وتعمل مع أي مزود لنماذج اللغة الكبيرة، وهي متوفرة بنسختين: خدمة مستقلة وملحق ext_proc لـ Envoy.
نشرت Cloud.ru الكود المصدري لـ Guardrails Filter، وهو وكيل عكسي شفاف بين العميل وموفري نماذج اللغات الكبيرة (LLM)، يقوم بإزالة البيانات الحساسة من الطلبات الموجهة إلى النموذج واستعادتها في الاستجابات. يكتشف الأداة ويخفي البيانات الشخصية (PII)، ومفاتيح واجهات برمجة التطبيقات (API)، وبيانات بطاقات الائتمان، وأرقام التأمين الاجتماعي (SNILS)، وأرقام التعريف الضريبي (INN)، وأرقام التسجيل الحكومي (OGRN)، وغيرها من أنواع المعلومات باستخدام أكثر من 260 قاعدة مدمجة تستند إلى التعبيرات العادية (regex) والمجاميع الاختبارية (checksums). تتم العملية في غضون ميكروثانية ولا تتطلب استدلالاً للتعلم الآلي (ML inference). يتوفر خياران للنشر: خدمة مستقلة على Go (صورة Docker واحدة، ثلاثة منافذ) وـ ext_proc sidecar لـ Envoy، الذي يطبق الحماية مركزياً على جميع الطلبات عبر الحدود. يدعم Guardrails Filter تخزين البدائل في الذاكرة أو Redis أو PostgreSQL مع إمكانية التشفير، ويستعيد البيانات حتى في استجابات SSE المتدفقة واستدعاءات الأدوات (tool-calls). تتضمن الأداة وحدة تحكم ويب مدمجة مع تسجيل الأحداث (logging)، ومقاييس Prometheus، ولوحات معلومات Grafana، بالإضافة إلى وضع الاختبار Ghost Mode. يبلغ متوسط الدقة (precision) 92–99.9%، والاسترجاع (recall) 75–87%، ونقاط F1 (F1-score) 82–93%. تُستخدم الأداة بالفعل داخل منصة Cloud.ru Evolution Foundation Models.
المصدر: Habr — хаб ИИ —
الأصلي
