AI对抗AI:每次使用都会更强的智能体运行时安全方案
Tencent
腾讯安全专家段浩通将在2026年深圳AICon大会上分享针对AI智能体的全链路运行时安全解决方案,利用AI对抗AI。该方法覆盖事前、事中和事后防御,包括提示注入检测、意图偏离检测、沙箱隔离和数据泄露防护,并基于实际生产数据实现持续自我优化。
资深腾讯安全专家段浩通拥有12年经验,将于8月21日至22日在深圳举办的AICon 2026大会上发表演讲。他的演讲主题为“以AI对抗AI:构建越用越强的智能体运行时安全防线”,聚焦于智能体进入企业核心场景后出现的提示注入、意图偏离、工具滥用和数据泄露等新兴风险。他认为,传统基于规则的安全防护在语义攻击和非确定性行为面前无能为力。其提出的解决方案采用第一性原理,构建AI原生安全体系,涵盖事件前的提示注入检测(从关键词匹配升级为语义理解)、事件中的意图偏离检测及通过智能体沙箱实现工具隔离执行,以及事件后的数据泄露防护(通过出站保护和小模型微调)。该系统依赖真实生产数据驱动的自迭代反馈循环。本次大会还设有十个论坛,涵盖AI基础设施、推理工程、机器人通用人工智能(AGI)和智能体安全等主题,来自腾讯、阿里巴巴、华为、百度、蚂蚁集团的五十余位专家将参与分享。
来源: InfoQ 中国 —
原文
