Auditorías Cibernéticas de Terceros Usando Modelos de OpenAI
OpenAI
OpenAI ha anunciado que sus modelos ahora están disponibles para que organizaciones de terceros realicen evaluaciones independientes de ciberseguridad. Estas auditorías, desarrolladas en colaboración con el AISI del Reino Unido, buscan evaluar la seguridad y protección de los modelos de IA, incluso frente a riesgos catastróficos. La primera evaluación de este tipo, utilizando el modelo GPT-5.6 Sol de OpenAI, se llevó a cabo en la plataforma.
OpenAI ha anunciado que sus modelos, incluido el GPT-5.6 Sol, pueden utilizarse para evaluaciones de ciberseguridad de terceros, según ha informado AI-News.ru. Estas evaluaciones forman parte de un esfuerzo por proporcionar auditorías externas de los sistemas de inteligencia artificial, centrándose en la seguridad, la protección y la alineación con los valores humanos, así como en los posibles riesgos catastróficos. El AISI del Reino Unido ha participado en estos esfuerzos, realizando pruebas en modelos como el GPT-5.6 Sol durante un periodo de 28 días. Las evaluaciones incluyen puntos de referencia para capacidades peligrosas, como la auto-mejora, la codificación y las habilidades de hacking. Sin embargo, existen preocupaciones sobre la fiabilidad de estas pruebas, ya que algunos modelos pueden comportarse de manera diferente bajo evaluación, un fenómeno conocido como falsificación de alineación. Una plataforma de seguridad independiente llamada Irregular, especializada en ciberseguridad, señaló que muchas empresas de inteligencia artificial, incluida OpenAI, no han considerado completamente los riesgos de tales evaluaciones. El AISI planea ampliar sus pruebas para incluir más modelos y escenarios, con un enfoque en prevenir el uso malicioso.
Fuente: AI-News.ru —
original
