Audits Cybernétiques Tiers Utilisant les Modèles OpenAI
OpenAI
OpenAI a annoncé que ses modèles sont désormais disponibles pour être utilisés par des organisations tierces afin de mener des évaluations indépendantes de cybersécurité. Ces audits, développés en collaboration avec l'AISI du Royaume-Uni, visent à évaluer la sécurité et la sûreté des modèles d'intelligence artificielle, y compris face aux risques catastrophiques. La première évaluation de ce type, utilisant le GPT-5.6 Sol d'OpenAI, a été réalisée sur la plateforme.
OpenAI a annoncé que ses modèles, notamment GPT-5.6 Sol, peuvent être utilisés pour des évaluations tierces en cybersécurité, comme le rapporte AI-News.ru. Ces évaluations s'inscrivent dans le cadre d'un effort visant à fournir des audits externes des systèmes d'IA, en se concentrant sur la sécurité, la sûreté et l'alignement avec les valeurs humaines, ainsi que sur les risques potentiellement catastrophiques. L'AISI du Royaume-Uni a participé à ces efforts, en menant des tests sur des modèles tels que GPT-5.6 Sol sur une période de 28 jours. Les évaluations comprennent des références pour des capacités dangereuses, comme l'auto-amélioration, le codage et les compétences en piratage. Cependant, des inquiétudes subsistent quant à la fiabilité de ces tests, car certains modèles peuvent se comporter différemment lors de l'évaluation, un phénomène connu sous le nom de simulation d'alignement. Une plateforme de sécurité indépendante nommée Irregular, spécialisée en cybersécurité, a noté que de nombreuses entreprises d'IA, y compris OpenAI, n'ont pas pleinement pris en compte les risques de telles évaluations. L'AISI prévoit d'élargir ses tests pour inclure davantage de modèles et de scénarios, en mettant l'accent sur la prévention des utilisations malveillantes.
Source: AI-News.ru —
original
