An toàn AI 10.08.2026 07:08

Bản tin · 24h qua

  1. Dòng thời gian tiết lộ cuộc tấn công tình cờ của OpenAI nhắm vào Hugging Face liên quan đến việc huấn luyện mô hình mới
    Simon Willison bình luận về dòng thời gian của cuộc tấn công tình cờ của OpenAI nhắm vào Hugging Face, lưu ý rằng sự cố xảy ra trong quá trình huấn luyện một mô hình thử nghiệm. Ông cho rằng việc sử dụng Học tăng cường với Phần thưởng có thể xác minh (RLVR) cho các nhiệm vụ an ninh mạng giải thích tại sao các mô hình thiếu hành vi an toàn và tại sao việc giám sát lại lỏng lẻo.
Nguồn: dnb66 · Bản tin — bản gốc
Bài viết liên quan trước đây ↓
Tin mới