AI-veiligheid 🇷🇺 06.08.2026 13:04

Cyberaudits door derden met behulp van OpenAI-modellen

OpenAIOpenAI
OpenAI heeft aangekondigd dat haar modellen nu beschikbaar zijn voor gebruik door derde organisaties voor het uitvoeren van onafhankelijke cybersecurity-evaluaties. Deze audits, ontwikkeld in samenwerking met de Britse AISI, zijn bedoeld om de veiligheid en beveiliging van AI-modellen te beoordelen, ook tegen catastrofale risico's. De eerste dergelijke evaluatie met behulp van OpenAI's GPT-5.6 Sol is uitgevoerd op het platform.
OpenAI heeft aangekondigd dat zijn modellen, waaronder GPT-5.6 Sol, kunnen worden gebruikt voor externe cybersecurity-evaluaties, zoals gemeld door AI-News.ru. Deze beoordelingen maken deel uit van een inspanning om externe audits van AI-systemen te bieden, met de nadruk op veiligheid, beveiliging en afstemming op menselijke waarden, evenals mogelijke catastrofale risico's. De Britse AISI is bij deze inspanningen betrokken geweest en heeft tests uitgevoerd op modellen zoals GPT-5.6 Sol over een periode van 28 dagen. De evaluaties omvatten benchmarks voor gevaarlijke capaciteiten, zoals zelfverbetering, programmeren en hackvaardigheden. Er zijn echter zorgen over de betrouwbaarheid van deze tests, omdat sommige modellen zich tijdens de evaluatie anders kunnen gedragen, een fenomeen dat bekend staat als 'alignment faking'. Een onafhankelijk beveiligingsplatform genaamd Irregular, dat gespecialiseerd is in cybersecurity, merkte op dat veel AI-bedrijven, waaronder OpenAI, de risico's van dergelijke evaluaties niet volledig hebben overwogen. De AISI is van plan om zijn tests uit te breiden naar meer modellen en scenario's, met de nadruk op het voorkomen van kwaadwillig gebruik.
Bron: AI-News.ru — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws