TekoälyturvallisuusTutkimus 🇨🇳 12.08.2026 17:02

Vuosittainen tekoälytutkimus: Kolmen johtavan mallin tislauksenestomekanismit murrettu, pienet mallit paljastavat piilotetut päättelyketjut, Kimi-K3:n toistuvuuspoikkeama

Moonshot AIMoonshot AI
Uusi tieteellinen tutkimus väittää murtaneensa maailman kolmen parhaan tekoälymallin tislauksenestomekanismit, mikä mahdollistaa pienten mallien piilotettujen päättelyketjujen paljastamisen. Poikkeama toistettiin Kimi-K3:n kanssa.
Vuosittaisessa tekoälyraportissa kerrotaan kattavasta läpimurrosta kolmen johtavan tekoälymallin tislauksen vastaisissa puolustusmekanismeissa. Tutkijat osoittivat, että pienet mallit pystyvät tehokkaasti poimimaan piilotetun ajatusketjun suuremmista malleista, mikä heikentää suojauksia, jotka on suunniteltu estämään tällainen poiminta. Ilmiö toistettiin todennäköisyyspoikkeamalla, joka liittyi Moonshot AI:n malliin Kimi-K3. Tämä kehitys herättää huolta edistyneiden tekoälyjärjestelmien turvallisuudesta ja immateriaalioikeuksista.
Lähde: Moonshot Kimi (GNews) — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset