KI-Sicherheit RSS

KI-Sicherheit 🇺🇸

Google DeepMind stellt Gemini 3.5 Flash Cyber vor – ein leichtgewichtiges Modell für Cybersicherheit

Google DeepMind hat Gemini 3.5 Flash Cyber angekündigt, ein spezialisiertes Modell basierend auf 3.5 Flash, das für Schwachstellensuche, -verifikation und -behebung optimiert wurde. Das Modell wird im Rahmen eines begrenzten Pilotprogramms für Regierungen und vertrauenswürdige Partner verfügbar sein, um kritische Schwachstellen proaktiv zu beheben.

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind24.07 · 11:04
KI-Sicherheit 🇷🇺

Prompt-Injection kann nicht durch Filter geheilt werden: Wie man unzuverlässigen Text mit Architekturmustern isoliert

Prompt-Injection ist ein struktureller Defekt in großen Sprachmodellen, bei dem unzuverlässiger Text als Anweisung ausgeführt wird. Filter und System-Prompts sind wirkungslos: Selbst die besten Abwehrmechanismen werden bei adaptiven Angriffen in 90% der Fälle durchbrochen. Erfolgreiche Ansätze – Dual-LLM, CaMeL und die Two-Meta-Regel – setzen auf Isolation, anstatt zwischen Gut und Böse unterscheiden zu wollen.

OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind MicrosoftMicrosoft
Habr — хаб ИИ24.07 · 11:01
Aktuelle Nachrichten