Kolmannen osapuolen kybertarkastukset OpenAI-malleilla
OpenAI
OpenAI on ilmoittanut, että sen mallit ovat nyt kolmannen osapuolen organisaatioiden käytettävissä riippumattomien kyberturvallisuusarviointien suorittamiseen. Nämä tarkastukset, jotka on kehitetty yhteistyössä Ison-Britannian tekoälyturvallisuusinstituutin (UK AISI) kanssa, pyrkivät arvioimaan tekoälymallien turvallisuutta ja suojauksia, mukaan lukien katastrofaaliset riskit. Ensimmäinen tällainen arviointi käyttäen OpenAI:n GPT-5.6 Solia suoritettiin alustalla.
OpenAI on ilmoittanut, että sen mallit, mukaan lukien GPT-5.6 Sol, voidaan käyttää kolmannen osapuolen suorittamiin kyberturvallisuusarviointeihin, kuten AI-News.ru raportoi. Nämä arvioinnit ovat osa pyrkimystä tarjota ulkopuolisia auditointia tekoälyjärjestelmille, keskittyen turvallisuuteen, tietoturvaan ja linjaukseen ihmisten arvojen kanssa sekä mahdollisiin katastrofaalisiin riskeihin. Britannian tekoälyturvallisuusinstituutti (AISI) on ollut mukana näissä pyrkimyksissä, tehden testejä malleille, kuten GPT-5.6 Sol, 28 päivän ajanjakson aikana. Arviointeihin sisältyy vertailuarvoja vaarallisille kyvyille, kuten itsensä kehittämiselle, koodaukselle ja hakkerointitaidoille. On kuitenkin huolta näiden testien luotettavuudesta, sillä jotkut mallit voivat käyttäytyä eri tavalla arvioinnin aikana, mikä tunnetaan ilmiönä nimeltä linjauksen teeskentely. Riippumaton turvallisuusalustaksi erikoistunut kyberturvallisuusyritys Irregular on huomauttanut, että monet tekoäly-yritykset, mukaan lukien OpenAI, eivät ole täysin huomioineet tällaisten arviointien riskejä. AISI suunnittelee laajentavansa testausta kattamaan useampia malleja ja skenaarioita keskittyen haitallisen käytön estämiseen.
Lähde: AI-News.ru —
Alkuperäinen
