Lakera

Berita AI terbaru, model, dan rilis dari Lakera.

Keamanan AI 🇷🇺

Sisi Gelap LLM: Bagaimana dan Mengapa Mereka Diubah Menjadi Senjata (dan Apa yang Harus Dilakukan)

Model Bahasa Besar (LLM) rentan terhadap serangan jailbreak yang melewati mekanisme keamanannya, sehingga memungkinkan mereka menghasilkan konten berbahaya seperti instruksi untuk kejahatan. Aktor ancaman juga menggunakan LLM black-hat khusus untuk kejahatan siber. Pertahanan mencakup penyaringan berlapis, pelatihan adversarial, dan pengumpulan data serangan dari kerumunan melalui proyek seperti Gandalf.

DeepSeekDeepSeek OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind MetaMeta LakeraLakera
Habr — хаб ИИ10.08 · 12:03
Berita terbaru