アプリケーションAI安全性 🇷🇺 06.08.2026 08:04

Reddit、ポストのルール遵守を評価するAIを展開

Redditは、大規模言語モデル(大規模言語モデル、LLM)を使用して、コミュニティのルールに対する投稿やコメントをチェックする「Rules Hub」と呼ばれる新しいシステムを導入しました。このツールは既存のモデレーションを補完し、キーワード検索を超えた複雑なケースを処理し、700以上のコミュニティでテストされています。
Redditは、大規模言語モデル(LLM)を用いて投稿やコメントがコミュニティのルールを遵守しているかを評価するモデレーションツール「Rules Hub」を発表した。既存のAutoModボットが事前定義されたキーワードやパターンに依存するのに対し、Rules Hubは投稿の文脈を評価し、特定のコミュニティルールの意図と照合する。モデレーターは引き続きルールを作成し、違反時のアクションを決定する。このシステムは、投稿を自動的に追加レビューに回したり、非表示にしたり、削除したりすることができ、モデレーターはアーカイブされた投稿に対して新しいルールをテストしたり、AIの決定を説明するログを表示したりできる。過去数か月間、Rules HubはMod Council Networkプログラムのモデレーターとともに700以上のコミュニティでテストされ、現在は新しいサブレディットで利用可能となり、今年後半にはより広範囲に展開される予定だ。Redditは、このシステムが大規模なコミュニティでの既存のモデレーションを置き換える準備がまだできていないことを認めつつも、Rules HubをPost and Comment GuidanceやSafety Filtersなどの他の機能と統合し、AutoModが現在処理しているタスクを徐々に引き継ぐことを計画しており、最終的な制裁は人間のモデレーターに残される。
出典: 3DNews — 原文
関連記事 ↓
新着ニュース