Keamanan AI 🇷🇺 11.08.2026 22:01

Blok Penalaran Terenkripsi Claude: Melihat Lebih Dalam ke dalam Tanda Tangan di Tingkat Byte

AnthropicAnthropic
Sebuah artikel di Habr meneliti blok penalaran terenkripsi dari model-model Claude, mengungkapkan bahwa bidang 'signature' adalah sebuah protobuf yang membocorkan metadata seperti ID model dan UUID organisasi dalam teks biasa. Penulis menunjukkan bahwa penalaran sebenarnya dienkripsi dengan AES-GCM, tetapi panjangnya dapat disimpulkan, dan metadata tersebut menimbulkan risiko privasi jika log dibagikan.
Sebuah artikel baru di Habr merinci cara mengekstrak rantai penalaran tersembunyi dari model tertutup dengan memanfaatkan celah: penyerang mengambil blok terenkripsi dari model kuat, memberikannya ke model saudara yang lebih lemah dari penyedia yang sama, dan meminta penceritaan ulang kata demi kata, sehingga membaca pemikiran asli, termasuk kata sandi atau kunci yang tidak sengaja disertakan. Penulis mengungkapkan bahwa bidang 'tanda tangan' yang melekat pada setiap blok pemikiran Claude tidaklah buram: itu adalah protobuf yang dapat diurai tanpa kunci apa pun. Di dalamnya, hanya teks pemikiran aktual yang dienkripsi (AES-GCM, dengan tag 16 byte), sementara amplop luar dan header berisi metadata dalam teks biasa. Header mencakup ID model (misalnya, 'claude-opus-5'), jenis blok, dan, sejak versi 15 (Juli 2026), UUID organisasi dari ~/.claude.json pengguna. Metadata ini dicakup oleh MAC, sehingga blok tidak dapat dirusak, tetapi jika terekspos dalam log, dapat menghubungkan pengguna ke organisasi dan penggunaan model mereka. Penulis menyarankan bahwa kerentanan yang dijelaskan dalam pracetak mungkin dimitigasi oleh keberadaan metadata ini, tetapi risiko praktisnya adalah header tidak terenkripsi membocorkan informasi sensitif ketika log agen dibagikan.
Sumber: Habr — хаб ИИ — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru