Şifreleme Aşıldı: Yapay Zekâ Modelleri Kullanıcıların Hassas Verilerini Nasıl Kolayca İfşa Ediyor
Anthropic
OpenAI
Google/DeepMind
Alman araştırmacılar, ChatGPT, Claude ve Gemini gibi modellerin kullandığı şifrelenmiş 'akıl yürütme günlüklerini' istismar ederek yapay zekâ sohbet robotlarından parolalar ve API anahtarları gibi hassas verileri çıkarmanın bir yolunu buldu. Saldırı, bu günlükleri kopyalayıp aynı şirketin modellerinin eski veya değiştirilmiş sürümleriyle kullanarak şifrelemeyi etkili bir şekilde kırmaya dayanıyor. Ekip, 315.000'den fazla günlüğün şifresini çözerek 62 API anahtarı, 33 parola ve diğer kişisel bilgileri ortaya çıkardı.
Almanya'dan araştırmacılar, Anthropic, OpenAI ve Google'ın yapay zeka modellerinin hassas kullanıcı verilerini sızdırabildiğini gösteren 'Stealing Reasoning Traces from Proprietary LLM APIs' başlıklı bir makale yayımladı. Bu modeller akıl yürütme görevlerini yerine getirirken, sunucuya her yeni yanıtla birlikte bağlam sağlamak için 'muhakeme günlüğü' adı verilen şifrelenmiş bir dize gönderiyor. Araştırmacılar, muhakeme günlüklerinin kopyalanıp aynı şirketin daha eski veya değiştirilmiş modelleri de dahil olmak üzere diğer modellerinde kullanılabildiğini buldu. Değiştirilmiş bir modelin güvenlik önlemleri 'jailbreak' yöntemiyle kaldırılırsa, günlüklerin şifresini çözebiliyor. GitHub ve Hugging Face'teki 6.708 genel depoyu kullanarak 315.320 muhakeme günlüğünü başarıyla çözdüler; bunlar 62 API anahtarı, 33 parola, 24 erişim jetonu, 30 kişisel e-posta adresi ve proje bakımcılarının adlarını/adreslerini içeriyordu. Bu bilgilerin çoğu yalnızca muhakeme günlüklerinde bulunuyordu, sohbet oturumunun başka bir yerinde yoktu. Cybernews'ten güvenlik uzmanı Voldemaras Kadys, şifrelemenin geleneksel anlamda kırılmadığını; bunun yerine uyumlu modeller arasında şifrelenmiş muhakeme izlerinin paylaşılmasının daha zayıf modellerin şifre çözme için bir ana anahtar haline gelmesine olanak tanıdığını belirtiyor. Muhakeme günlüklerine hassas veri muamelesi yapılmasını ve asla paylaşılmamasını tavsiye ediyor.
Kaynak: t3n —
orijinal
