AI-veiligheidOnderzoek 🇺🇸 03.08.2026 17:02

Zelfvoorzienende AI-virussen en het tempo van vooruitgang: deze week in AI

OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind MetaMeta
Onderzoekers demonstreren een zichzelf replicerende AI-worm die gebruikmaakt van opengewicht-LLM's om computers te compromitteren en zichzelf in stand te houden, met een slagingspercentage van ongeveer 37% voor volledige aanvallen. In ander nieuws voorspelt Dwarkesh Patel dat de rekenkosten zullen stijgen naarmate AI slimmer wordt, ondertekenen meer dan 1300 medewerkers van AI-laboratoria een verklaring waarin zij Amerikaanse steun vragen voor het tempo van de ontwikkeling van frontier-AI, en suggereert een nieuwe studie dat AI-systemen uitblinken in engineering maar creatieve onderzoekscapaciteiten missen, waarbij beide schaduwgeëvalueerde papers werden afgewezen.
Een team van de Universiteit van Toronto, het Vector Institute, de Universiteit van Cambridge en ServiceNow heeft een prototype computervirus gebouwd dat gebruikmaakt van open-weight large language models (LLM's) om inferentie uit te voeren op gecompromitteerde GPU-knooppunten, waardoor het in staat is om aanvallen te beredeneren en uit te voeren. De worm, die opereert met een aangepaste harness en een redeneergraaf, behaalde een succespercentage van ongeveer 80% bij het detecteren van kwetsbaarheden, 53% bij het exploiteren ervan, en 88% bij zelfreplicatie, wat neerkomt op een totaal aanvalssuccespercentage van ongeveer 37%. Dit benadrukt de opkomst van zelfvoorzienende AI-gedreven cyberdreigingen. Afzonderlijk beargumenteert Dwarkesh Patel dat naarmate AI-systemen slimmer worden, de prijzen voor rekenkracht zullen stijgen, omdat ze dezelfde hoeveelheid rekenkracht beter kunnen gelde maken, mogelijk door een H100 te huren voor meer dan 250.000 dollar per jaar, hoewel robotisering van de toeleveringsketen de kosten uiteindelijk zou kunnen verlagen. Ondertussen hebben meer dan 1.300 werknemers van grote AI-labs, waaronder OpenAI, Anthropic, Google DeepMind, Meta en Safe Superintelligence Inc., een verklaring ondertekend waarin zij de Amerikaanse overheid vragen om een internationale inspanning te steunen om instrumenten te ontwikkelen die opzettelijk de ontwikkeling van geautomatiseerde AI aan de grens kunnen vertragen, daarbij verwijzend naar risico's van snelle versnelling die buiten de menselijke controle komt. In onderzoek heeft een samenwerking tussen Princeton, Stanford en andere instellingen een 'schaduwevaluatie' uitgevoerd, waarbij AI-systemen (Claude Opus 4.8 in de OpenClaw-harness) probeerden te antwoorden op niet-gepubliceerde onderzoeksvragen uit NeurIPS 2026-inzendingen; beide pogingen werden door de oorspronkelijke auteurs afgewezen vanwege een gebrek aan nieuwe bijdragen en een slechte experimentele opzet, wat aangeeft dat AI-systemen sterk zijn in techniek, maar zwak in creatief onderzoek. De bevindingen suggereren dat de tijdlijnen voor recursieve zelfverbetering (RSI) langer kunnen zijn dan sommigen anticiperen.
Bron: Import AI — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws