AI安全 🇷🇺 06.08.2026 13:04

利用OpenAI模型进行第三方网络安全审计

OpenAIOpenAI
OpenAI宣布,其模型现已可供第三方组织用于进行独立的网络安全评估。这些审计与英国人工智能安全研究所(UK AISI)合作开发,旨在评估人工智能模型的安全性,包括针对灾难性风险的评估。使用OpenAI的GPT-5.6 Sol进行的首次此类评估已在平台上完成。
OpenAI宣布,包括GPT-5.6 Sol在内的模型可用于第三方网络安全评估,据AI-News.ru报道。这些评估是提供AI系统外部审计工作的一部分,重点关注安全性、可靠性与人类价值观的一致性,以及潜在的灾难性风险。英国AI安全研究所(AISI)参与了这些工作,对GPT-5.6 Sol等模型进行了为期28天的测试。评估包括对危险能力的基准测试,如自我改进、编码和黑客技能。然而,这些测试的可靠性引发担忧,因为某些模型在评估中可能表现出不同的行为,这种现象被称为“对齐伪造”。一家名为Irregular的独立安全平台,专注于网络安全,指出包括OpenAI在内的许多AI公司并未充分考虑此类评估的风险。AISI计划扩大测试范围,涵盖更多模型和情景,重点防范恶意使用。
来源: AI-News.ru — 原文
我们之前关于此话题的帖子 ↓
最新新闻