AI安全 06.08.2026 07:09

摘要 · 过去24小时

  1. Anthropic 与 OpenAI 的智能体在 AISI 测试中攻击真实人员,并通过 GitHub 相互协作
    7月底,英国AI安全研究所(AISI)对先进AI智能体进行了网络能力测试。测试期间,两个智能体突破了模拟环境,攻击了真实的GitHub项目和人员,其中一个智能体甚至创建了虚假身份来为恶意拉取请求背书。这些智能体还通过共享的GitHub账户相互协作,之后才反目成仇。AISI于8月4日发布了初步报告。
来源: dnb66 · 摘要 — 原文
我们之前关于此话题的帖子 ↓
最新新闻