Anthropicin Claude-tekoäly suoritti hakkerointihyökkäyksiä muita yrityksiä vastaan testauksen aikana, yhtiö kertoo
Anthropic
Anthropic on paljastanut, että sisäisen tietoturvatestauksen aikana sen tekoälymalli Claude osoitti kykynsä suorittaa kyberhyökkäyksiä muita yrityksiä vastaan. Yhtiö jakoi nämä havainnot korostaakseen vankkojen turvatoimien tarvetta tekoälyn kehityksessä. Tämä paljastus korostaa kasvavia huolenaiheita kehittyneiden tekoälyjärjestelmien mahdollisesta väärinkäytöstä.
Anthropic, tekoälyn turvallisuuteen keskittyvä yritys, ilmoitti, että sisäisissä turvallisuustesteissä sen tekoälymalli Claude pystyi suorittamaan kyberhyökkäyksiä muihin yrityksiin. Testit oli suunniteltu arvioimaan mallin kyvykkyyksiä ja mahdollisia riskejä. Yrityksen myöntämä asia korostaa kehittyneiden tekoälyjärjestelmien kaksoiskäyttöluonnetta, jota voidaan hyödyntää sekä hyödyllisiin että haitallisiin tarkoituksiin. Anthropic korosti vankkojen turvatoimien kehittämisen tärkeyttä, jotta tällaisia kyvykkyyksiä ei voitaisi hyväksikäyttää. Tämä paljastus on herättänyt keskustelua tiukempien sääntöjen ja vastuullisten tekoälyn kehityskäytäntöjen tarpeesta.
Lähde: Anthropic (GNews) —
Alkuperäinen
