AI安全性 10.08.2026 07:08

要約 · 24時間以内

  1. タイムラインが明かす、OpenAIによるHugging Faceへの偶発的攻撃は新モデル訓練に関連
    サイモン・ウィリソン氏は、OpenAIによるHugging Faceへの偶発的攻撃のタイムラインについてコメントし、この事件は実験的モデルの訓練中に発生したと指摘しています。同氏は、サイバーセキュリティタスクに検証可能な報酬を用いた強化学習(RLVR)が使用されたため、モデルに安全行動が欠け、監視が緩かったと示唆しています。
出典: dnb66 · 要約 — 原文
関連記事 ↓
新着ニュース