AI安全 🇷🇺 05.08.2026 16:02

测试俄罗斯大语言模型对OWASP LLM10的防御能力:无界资源消耗攻击

ЯндексЯндекс СберСбер
来自AI红队项目的研究人员测试了俄罗斯旗舰模型YandexGPT Lite 5和GigaChat Lite,以应对OWASP LLM10中的无界资源消耗攻击。他们使用精心构造的提示词触发递归上下文扩展、分形嵌套、组合爆炸以及多智能体模拟,旨在增加计算负载。该研究强调,传统防御措施不足以应对此类资源耗尽攻击。
文章讨论了OWASP LLM10:无界消耗类别,该类别关注的是迫使语言模型执行不成比例的大量计算,从而导致资源耗尽和拒绝服务的攻击。研究人员准备了代表各种攻击类别的恶意提示,包括递归上下文扩展(类Quine递归)、分形嵌套、计算爆炸、语义组合爆炸、多智能体模拟以及故障令牌滥用。这些提示可能导致模型生成过长的响应、模拟数千个实体或递归分析自身推理过程,同时表面上看起来像是合法的用户请求。研究使用AI红队网络服务测试了两款俄罗斯旗舰LLM,即YandexGPT Lite 5和GigaChat Lite,该服务支持超过2000个恶意提示,其中200个针对OWASP LLM10。评估采用LLM作为评判员并进行人工验证。文章强调,传统安全措施如关键词过滤效果不佳,并突显了构建更强健架构防御的必要性。
来源: Habr — хаб ИИ — 原文
我们之前关于此话题的帖子 ↓
最新新闻