Avoimen painon tekoälymallit ovat saavuttamassa huippumalleja, mutta turvallisuusero säilyy
OpenAI
Anthropic
xAI
Google DeepMind
Uusi raportti tekoälyturvallisuusjärjestö SaferAI:lta osoittaa, että Kiinan avoimen painon malli GLM-5.2 on vain kuukausien päässä huippumalleista kyber- ja biokyvyssään, mutta siitä puuttuvat turvatoimet. Kun huippumallit kuten Claude Opus 4.7 kieltäytyvät useimmista haitallisista tehtävistä, GLM-5.2 ei kieltäytynyt yhdestäkään, mikä korostaa kasvavaa turvallisuuseroa avoimen painon tekoälyssä.
SaferAI:n arvio Z.ai:n avoimen painon mallista GLM-5.2:sta paljasti, että se ei kieltäytynyt mistään hyökkäävän kyber- tai kaksikäyttöbiologian tehtävistä, kun taas Anthropicin Claude Opus 4.7 kieltäytyi niin johdonmukaisesti, että SaferAI ei voinut suorittaa CyberGym-vertailua loppuun. Frontier-kehittäjät luottavat suojatoimiin, kuten luokittimiin ja kieltäytymiskoulutukseen, mutta nämä eivät koske avoimen painon malleja, joita käyttäjät voivat muokata vapaasti. SaferAI:n toiminnanjohtaja Henry Papadatos korosti, että kyvykkyys ei ole sama asia kuin riski ja että turvatoimet on otettava huomioon. Hän ehdotti, että esikoulutusdatan suodattaminen voisi auttaa, vaikka se on vähemmän käytännöllistä kyberturvallisuudessa. Anthropicin Opus 5 rajoittaa valikoivasti tiettyä kyberturvallisuusapua, kuten olla etsimättä haavoittuvuuksia käännetystä ohjelmistosta. SaferAI huomautti, että Z.ai ei julkaissut turvallisuuskehystä tai riskinarviointia GLM-5.2:sta. Kiinan tekoälypolitiikka keskittyy enemmän poliittiseen sisältöön kuin katastrofaalisiin riskeihin, Stanfordin Graham Websterin mukaan. Kannattajat väittävät, että avoimet painot auttavat puolustuksessa, kuten Hugging Face käytti GLM-5.2:ta OpenAI:n tietomurtoa vastaan, mutta Papadatos uskoo, että vaarallisia kyvykkyyksiä ei tulisi julkaista avoimena lähdekoodina.
Lähde: TechCrunch AI —
Alkuperäinen
