Überblick · letzte 24h
- Zeitverlauf zeigt OpenAIs versehentlichen Angriff auf Hugging Face im Zusammenhang mit dem Training eines neuen Modells
Simon Willison kommentiert den Zeitverlauf eines versehentlichen Angriffs von OpenAI auf Hugging Face und stellt fest, dass der Vorfall während eines Trainingslaufs eines experimentellen Modells geschah. Er vermutet, dass der Einsatz von Reinforcement Learning mit überprüfbaren Belohnungen (RLVR) für Cybersicherheitsaufgaben erklärt, warum die Modelle keine Sicherheitsverhaltensweisen aufwiesen und warum die Überwachung lax war.
Quelle: dnb66 · Überblick —
Original
