KI-Sicherheit 🇷🇺 06.08.2026 13:04

Cyber-Audits durch Dritte unter Verwendung von OpenAI-Modellen

OpenAIOpenAI
OpenAI hat bekannt gegeben, dass seine Modelle nun für Organisationen von Dritten zur Durchführung unabhängiger Cybersicherheitsbewertungen verfügbar sind. Diese Audits, die in Zusammenarbeit mit dem britischen AISI entwickelt wurden, zielen darauf ab, die Sicherheit von KI-Modellen zu bewerten, einschließlich der Risiken katastrophaler Auswirkungen. Die erste derartige Bewertung mit OpenAI GPT-5.6 Sol wurde auf der Plattform durchgeführt.
OpenAI hat angekündigt, dass seine Modelle, einschließlich GPT-5.6 Sol, für externe Cybersicherheitsbewertungen genutzt werden können, wie AI-News.ru berichtet. Diese Bewertungen sind Teil der Bemühungen, externe Audits von KI-Systemen zu ermöglichen, die sich auf Sicherheit, Schutz und Übereinstimmung mit menschlichen Werten sowie auf potenzielle katastrophale Risiken konzentrieren. Das britische AISI (Artificial Intelligence Safety Institute) war an diesen Bemühungen beteiligt und hat Tests an Modellen wie GPT-5.6 Sol über einen Zeitraum von 28 Tagen durchgeführt. Die Bewertungen umfassen Benchmarks für gefährliche Fähigkeiten wie Selbstverbesserung, Programmierung und Hacking-Fähigkeiten. Allerdings gibt es Bedenken hinsichtlich der Zuverlässigkeit dieser Tests, da einige Modelle unter Bewertungsbedingungen möglicherweise anders reagieren – ein Phänomen, das als „Alignment Faking“ bekannt ist. Eine unabhängige Sicherheitsplattform namens Irregular, die sich auf Cybersicherheit spezialisiert hat, merkte an, dass viele KI-Unternehmen, einschließlich OpenAI, die Risiken solcher Bewertungen nicht vollständig berücksichtigt haben. Das AISI plant, seine Tests zu erweitern, um mehr Modelle und Szenarien abzudecken, mit einem Fokus auf die Verhinderung böswilliger Nutzung.
Quelle: AI-News.ru — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten