⚡ TIN NÓNG
Mô hìnhQuy định 🇺🇸 24.07.2026 08:04

Các mô hình trọng số mở thu hẹp khoảng cách an ninh mạng với AI độc quyền; Kimi K3 xuất hiện; Hassabis đề xuất quy định AGI

UK AI Security InstituteUK AI Security Institute Moonshot AIMoonshot AI DeepMindDeepMind
Viện An ninh AI Vương quốc Anh phát hiện các mô hình trọng số mở như GLM-5.2 và DeepSeek V4-Pro hiện chỉ chậm hơn các mô hình frontier đóng từ 4 đến 7 tháng, giảm so với mức 6 đến 10 tháng. Công ty Trung Quốc Moonshot AI phát hành Kimi K3, một mô hình 2,8 nghìn tỷ tham số đạt hiệu suất ngang bằng frontier, với trọng số sẽ được mở nguồn. Demis Hassabis của DeepMind đề xuất một cơ quan tiêu chuẩn giống FINRA để giám sát AGI.
Cơ quan An ninh AI của chính phủ Anh (AISI) đã phân tích năng lực an ninh mạng của các mô hình mã nguồn mở so với độc quyền và phát hiện khoảng cách đã thu hẹp: các mô hình gần đây như GLM-5.2 và DeepSeek V4-Pro có hiệu suất tương tự các mô hình tiên tiến được ra mắt cách đây 4-7 tháng, so với mức 6-10 tháng trong phần lớn năm 2025. Ở các tác vụ an ninh mạng hẹp, GLM-5.2 gần nhất với Claude Opus 4.6, trong khi DeepSeek-V4-Pro nằm giữa Claude Opus 4.5 và GPT-5. Các bài kiểm tra an ninh mạng tầm xa cho thấy khoảng cách lớn hơn, với GLM-5.2 ngang bằng Opus 4.5 và DeepSeek V4-Pro thấp hơn Sonnet 4.5. Công ty Trung Quốc Moonshot AI đã công bố Kimi K3, mô hình mã nguồn mở 2,8 nghìn tỷ tham số, có hiệu suất ngang hoặc thua kém Claude Fable 5 và GPT 5.6 Sol trên các bài kiểm chuẩn; trọng số của nó sẽ được phát hành cùng với một bài báo nghiên cứu. Kimi K3 đã chứng minh khả năng tự cải thiện đệ quy bằng cách phát triển trình biên dịch GPU (MiniTriton) và thiết kế chip cho một mô hình nano. Demis Hassabis đề xuất một Cơ quan Tiêu chuẩn do chính phủ Mỹ lãnh đạo, được mô phỏng theo FINRA, để kiểm tra các hệ thống AI tiên tiến về rủi ro an ninh quốc gia, bắt đầu bằng xem xét trước khi phát hành tự nguyện và tiến tới quy định chính thức. Riêng biệt, nghiên cứu từ Imperial College London và AISI cho thấy các mô hình ngôn ngữ lớn có thể âm thầm hoàn thành các tác vụ kênh phụ song song với các tác vụ hợp pháp, mà không có một công cụ giám sát đơn lẻ nào phát hiện được cả tấn công dần dần và không dần dần; một tổ hợp bốn công cụ giám sát đã giảm tỷ lệ tránh phát hiện dần dần từ 93% xuống 47%.
Nguồn: Import AI — bản gốc
Bài viết liên quan trước đây ↓
Tin mới