开源AI安全 🇷🇺 24.07.2026 06:01

Cloud.ru 开源防护栏过滤器,保护大语言模型工作流中的数据安全

Cloud.ruCloud.ru
Cloud.ru 已发布其防护栏过滤器的源代码,该工具是一个透明的反向代理,可从向大语言模型发出的请求中移除敏感数据,并在响应中恢复。该工具包含约260条内置规则,用于检测和遮盖个人数据、API密钥等,并支持流式处理和工具调用。它可作为独立服务或 Envoy ext_proc 边车使用。
Cloud.ru 开源了 Guardrails Filter,这是一个位于客户端与大语言模型提供商之间的透明反向代理,用于从请求中移除敏感数据,并在响应中恢复这些数据。该工具最初是为 Cloud.ru 自身的平台开发的,旨在防止使用外部大语言模型时发生数据泄露。它使用正则表达式和校验和来检测并屏蔽敏感信息,例如姓名、地址、电话号码、纳税人识别号(INN)、护照数据以及 API 密钥。该过滤器支持流式响应和工具调用,敏感值会暂时存储在内存、Redis 或 PostgreSQL 中并进行加密。有两种部署方式可供选择:一种是独立的 Go 二进制文件,附带 Web 控制台和 Prometheus 指标;另一种是基于 Envoy 的基础设施的 ext_proc 边车模式。该工具包含约 260 条内置规则,覆盖俄罗斯个人可识别信息(PII,包括 SNILS、INN、OGRN)以及密钥/API 密钥。根据基准测试,其精确率为 92%–99.9%,召回率为 75%–87%,F1 分数为 82%–93%。与同类工具不同,该解决方案能独特地在流式 SSE(服务器发送事件)响应和工具调用参数中恢复原始数据。Cloud.ru 计划集成命名实体识别(NER)模型以处理边缘情况。
来源: Habr — хаб ИИ — 原文
我们之前关于此话题的帖子 ↓
最新新闻