Kooste · viimeiset 24h
- Aikajana paljastaa OpenAI:n vahingossa tapahtuneen hyökkäyksen Hugging Facea vastaan liittyen uuden mallin koulutukseen
Simon Willison kommentoi aikajanaa OpenAI:n vahingossa tapahtuneesta hyökkäyksestä Hugging Facea vastaan ja toteaa, että tapaus sattui kokeellisen mallin koulutusajon aikana. Hän ehdottaa, että vahvistettavissa olevien palkkioiden vahvistusoppimisen (Reinforcement Learning with Verifiable Rewards, RLVR) käyttö kyberturvallisuustehtävissä selittää, miksi malleista puuttuivat turvallisuuskäyttäytymiset ja miksi seuranta oli löyhää.
Lähde: dnb66 · Kooste —
Alkuperäinen
