Keamanan AIRiset 🇨🇳 12.08.2026 17:02

Makalah AI Tahunan: Mekanisme Anti-Distilasi Tiga Model Terkemuka Berhasil Ditetrasi, Model Kecil Mengekstrak Rantai Penalaran Tersembunyi, Anomali Perulangan Kimi-K3

Moonshot AIMoonshot AI
Sebuah makalah akademis baru mengklaim telah menetrasi mekanisme anti-distilasi dari tiga model AI teratas dunia, memungkinkan model kecil mengekstrak rantai penalaran tersembunyi. Anomali tersebut direproduksi dengan Kimi-K3.
Sebuah laporan tahunan tentang AI mengungkapkan terobosan komprehensif dalam mekanisme pertahanan terhadap distilasi model dari tiga model AI terkemuka. Para peneliti menunjukkan bahwa model kecil dapat secara efektif mengekstrak rantai pemikiran tersembunyi dari model yang lebih besar, melemahkan perlindungan yang dirancang untuk mencegah ekstraksi semacam itu. Fenomena ini direproduksi dengan anomali probabilitas yang melibatkan Kimi-K3, sebuah model dari Moonshot AI. Perkembangan ini menimbulkan kekhawatiran tentang keamanan dan kekayaan intelektual sistem AI tingkat lanjut.
Sumber: Moonshot Kimi (GNews) — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru