AI安全研究 🇺🇸 31.07.2026 06:02

下载:大语言模型的漏洞与地热发电站的复兴

研究人员发现了大型语言模型工作中的一个根本性缺陷,该缺陷使得能够绕过其防护措施并获取危险信息。在新墨西哥州,Zanskar公司通过使用现代技术钻探新井,成功重振了一座日渐衰败的地热发电站。
据《麻省理工科技评论》报道,一个研究团队在顶级人工智能会议上提交了一篇论文,声称由于大型语言模型工作原理中存在一个根本性缺陷,无法使其完全免受黑客攻击。这一缺陷与模型如何确定指令来源有关,使得攻击者能够迫使模型输出其被训练所隐藏的信息,例如合成可卡因的方法或破坏飞机导航系统的手段。研究人员认为,这个问题可能是无法解决的。另一篇文章则讲述了一家名为Zanskar的小公司于2024年6月收购了新墨西哥州一座因地下储层冷却而日渐衰败的地热发电站。两年后,通过利用先进建模和现代钻井技术发现新井,该电站再次满负荷运转。这表明地下隐藏着尚未开发的无排放发电潜力。
来源: MIT Technology Review — 原文
我们之前关于此话题的帖子 ↓
最新新闻