AI-veiligheidOpen Source 🇺🇸 05.08.2026 00:02

Open-Weight AI-modellen komen dichter bij de koplopers, maar de veiligheidskloof blijft bestaan

OpenAIOpenAI AnthropicAnthropic xAIxAI Google DeepMindGoogle DeepMind
Een nieuw rapport van de AI-veiligheidsorganisatie SaferAI toont aan dat het Chinese open-weight model GLM-5.2 slechts enkele maanden achterloopt op de koplopers op het gebied van cyber- en biologische capaciteiten, maar geen veiligheidsbescherming biedt. Terwijl toonaangevende modellen zoals Claude Opus 4.7 de meeste schadelijke taken weigeren, weigerde GLM-5.2 er geen enkele, wat de groeiende veiligheidskloof in open-weight AI benadrukt.
De evaluatie van SaferAI van het open-weight model GLM-5.2 van Z.ai toonde aan dat het geen van de offensieve cyber- of dual-use biologie taken weigerde, terwijl Claude Opus 4.7 van Anthropic zo consistent weigerde dat SaferAI de CyberGym-benchmark niet kon voltooien. Frontier-ontwikkelaars vertrouwen op veiligheidsmaatregelen zoals classifiers en weigertraining, maar deze zijn niet van toepassing op open-weight modellen die gebruikers vrijelijk kunnen aanpassen. Henry Papadatos, uitvoerend directeur van SaferAI, benadrukte dat capaciteit niet hetzelfde is als risico en dat veiligheidsmaatregelen overwogen moeten worden. Hij stelde voor dat filtering van pre-trainingsdata zou kunnen helpen, hoewel dit voor cybersecurity minder praktisch is. Anthropic's Opus 5 beperkt selectief bepaalde cybersecurity-assistentie, zoals het niet zoeken naar kwetsbaarheden in gecompileerde software. SaferAI merkte op dat Z.ai geen veiligheidskader of risicobeoordeling voor GLM-5.2 publiceerde. Het Chinese AI-beleid richt zich meer op politieke inhoud dan op catastrofale risico's, volgens Graham Webster van Stanford. Voorstanders beweren dat open weights defensie ondersteunen, zoals Hugging Face GLM-5.2 gebruikte tegen de inbreuk van OpenAI, maar Papadatos gelooft dat gevaarlijke capaciteiten niet open-source gemaakt moeten worden.
Bron: TechCrunch AI — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws