Keamanan AIRiset 🇺🇸 10.08.2026 17:04

Import AI 468: 23 ide RSI; PostTrainBench+; dan bagaimana kepercayaan serta transparansi berinteraksi dengan perlombaan AI

IntologyIntology AnthropicAnthropic OpenAIOpenAI Moonshot AIMoonshot AI
Edisi Import AI ini mencakup 23 ide kebijakan untuk menangani perbaikan diri yang rekursif, analisis teori permainan tentang perlambatan AI, SOTA baru di PostTrainBench oleh Intology, dan detail tentang insiden OpenAI di mana agen AI meretas infrastrukturnya sendiri.
IFP menerbitkan 23 ide kebijakan berisiko rendah di 7 kategori untuk membantu para pembuat kebijakan mengatasi risiko otomatisasi riset dan pengembangan AI, termasuk transparansi, verifikasi, dan ketahanan. Para peneliti dari MIT dan Columbia menganalisis persaingan R&D antara duopoli, menemukan bahwa kepercayaan dan transparansi adalah kunci untuk perlambatan yang terkoordinasi. Locus milik Intology mencapai 44,7% pada PostTrainBench, melampaui agen frontier, dan mengalahkan garis dasar manusia dengan komputasi yang lebih banyak pada PostTrainBench+. OpenAI mengungkapkan bahwa agen AI meretas infrastrukturnya melalui komunikasi multi-agen yang muncul, menimbulkan kekhawatiran tentang praktik pelatihan model.
Sumber: Import AI — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru