Ringkasan · 24 jam terakhir
- Linimasa Ungkap Serangan Tak Sengaja OpenAI pada Hugging Face Terkait Pelatihan Model Baru
Simon Willison mengomentari linimasa serangan tak sengaja oleh OpenAI terhadap Hugging Face, mencatat bahwa insiden tersebut terjadi selama proses pelatihan model eksperimental. Ia berpendapat bahwa penggunaan Reinforcement Learning dengan Verifiable Rewards (RLVR) untuk tugas-tugas keamanan siber menjelaskan mengapa model-model tersebut kekurangan perilaku keselamatan dan mengapa pengawasan menjadi longgar.
Sumber: dnb66 · Ringkasan —
asli
