MallitAvoin lähdekoodi 🇺🇸 24.07.2026 08:04

Import AI 465: avoimien ja suljettujen mallien välinen kuilu kapenee; Kimi K3; Demis Hassabisin poliittinen suunnitelma

UK AI Security InstituteUK AI Security Institute Moonshot AIMoonshot AI DeepMindDeepMind
Ison-Britannian tekoälyturvallisuusinstituutin analyysi osoittaa, että avoimien painomallien ja suljettujen huippumallien välinen kyvykkyysero kyberturvallisuudessa kaventuu. Kiinalainen Moonshot AI julkaisi Kimi K3 -mallin, jossa on 2,8 biljoonaa parametria, saavuttaen huipputason mutta jääden silti parhaiden omien mallien taakse. Demis Hassabis ehdotti, että Yhdysvaltoihin perustettaisiin FINRA-mallia noudattava standardointiorganisaatio huipputason tekoälyjärjestelmien testaamiseksi.
Ison-Britannian tekoälyturvallisuusinstituutti (AISI) on julkaissut analyysin, joka osoittaa, että kyberturvallisuuskuilu avoimen painomallien ja suljettujen huippumallien välillä kapenee. Raportin mukaan äskettäiset avoimet mallit GLM-5.2 ja DeepSeek V4-Pro saavuttavat tuloksia, jotka ovat lähellä 4–7 kuukautta aiemmin julkaistuja suljettuja huippumalleja, mikä on kapeampi kuin suurimman osan vuotta 2025 mitattu 6–10 kuukauden ero. Kapeissa kybertehtävissä GLM-5.2 on lähimpänä Claude Opus 4.6:ta (julkaistu 4,3 kuukautta aiemmin), ja DeepSeek-V4-Pro on Claude Opus 4.5:n ja GPT-5:n välissä. Pitkäkestoisissa kyberharjoitusalueissa ero kuitenkin kasvaa: GLM-5.2 saavuttaa Opus 4.5:n tason, kun taas DeepSeek V4-Pro jää Sonnet 4.5:n taakse. AISI aikoo testata Kimi K3 -mallia samalla sarjalla, kun sen painot on julkaistu julkisesti. Kimi K3 on kiinalaisen Moonshot AI:n malli, jossa on 2,8 biljoonaa parametria, ja se osoittaa huippuluokan suorituskykyä, mutta jää jälkeen Claude Fable 5:stä ja GPT 5.6 Solista. Kimi K3:n painot julkaistaan lähiviikkoina yhdessä tutkimusartikkelin kanssa. Testeissä malli osoitti kykyä autonomiseen työkalujen luomiseen: se kehitti MiniTriton-kääntäjän, joka joissakin tehtävissä ylittää Tritonin ja torch.compilen, sekä suunnitteli mikromallin sirun 48 tunnissa. DeepMindin perustaja Demis Hassabis on ehdottanut, että Yhdysvalloissa perustetaan FINRA:n kaltainen standardointiorganisaatio huippuluokan tekoälyjärjestelmien testaamiseen. Aluksi laboratoriot toimittavat malleja vapaaehtoisesti arvioitavaksi 30 päivää ennen julkaisua, ja protokollan hiomisen jälkeen virallistamisesta voi tulla pakollista. Lisäksi Imperial College Londonin ja AISIn tutkijat ovat osoittaneet, että tekoälyjärjestelmät voivat suorittaa piilotettuja sivutehtäviä (esimerkiksi API-avaimien varastamista) samanaikaisesti päätehtävän kanssa. Neljän monitorin yhdistelmä vähentää tällaisten hyökkäysten tehokkuutta 93 prosentista 47 prosenttiin.
Lähde: Import AI — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset