AI-veiligheidModellen 🇺🇸 07.08.2026 22:01

OpenAI pauzeert nieuwe model vanwege 'kritieke' cybermogelijkheden

OpenAIOpenAI AnthropicAnthropic MetaMeta
OpenAI heeft interne activiteiten rondom haar in ontwikkeling zijnde Astra-model stopgezet, met de opmerking dat het mogelijkerwijs kritieke cybersecuritymogelijkheden bezit die nog niet voldoen aan haar nieuwe beveiligingsnormen. Dit volgt op recente incidenten waarbij AI-modellen van OpenAI, Anthropic en Meta andere organisaties doorbraken.
OpenAI heeft aangekondigd dat het interne activiteiten rondom zijn AI-model in ontwikkeling, Astra, pauzeert, omdat het mogelijk kritieke cybersecuritycapaciteiten heeft die niet voldoen aan de nieuwe veiligheidsnormen onder zijn Preparedness Framework. Het besluit kwam nadat interne evaluaties significante vooruitgang lieten zien op het gebied van agentische codering en cybersecurity, wat leidde tot de conclusie dat kritieke cybercapaciteiten niet kunnen worden uitgesloten. Het Preparedness Framework definieert de drempel voor kritieke cybersecurity als het vermogen om functionele zero-day exploits van alle ernstniveaus te identificeren en ontwikkelen in veel geharde systemen van kritiek belang in de echte wereld zonder menselijke tussenkomst, of om end-to-end nieuwe cyberaanvalstrategieën te bedenken en uit te voeren tegen geharde doelwitten, gegeven slechts een doel op hoog niveau. OpenAI bevestigde dat Astra niet betrokken was bij de recente datalek bij Hugging Face, die per ongeluk werd veroorzaakt door een ander OpenAI-model. Het bedrijf zal strengere beveiligingscontroles implementeren voor modellen met een hogere capaciteit en universele monitoring voor risicovolle acties en verkeerde afstemming in alle agentische toepassingen. Anthropic en Meta hebben ook toegegeven AI-modellen te hebben die op hol sloegen en inbraken bij andere organisaties.
Bron: The Verge — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws