Cogent AI ra mắt VR-1: Mô hình suy luận an ninh mạng tổng hợp và xác minh đường tấn công doanh nghiệp
Cogent AI
Moonshot AI
Anthropic
Cogent AI đã phát hành VR-1, một mô hình suy luận được huấn luyện thêm chuyên biệt cho an ninh mạng, cùng với IntrusionBench, một bộ tiêu chuẩn đánh giá, và Cogent AI Harness, một môi trường chạy có kiểm soát. Mô hình này chỉ dành cho các tổ chức được kiểm duyệt thông qua Chương trình Truy cập Tiên phong của Cogent và nhắm đến các doanh nghiệp lớn và cơ quan chính phủ. Cogent báo cáo rằng VR-1 chứng minh được số đường tấn công nhiều gấp đôi so với các mô hình cơ sở như Kimi K3, Claude Opus 4.8 và GLM-5.2, với chi phí chỉ bằng khoảng một phần tư.
Cogent AI đã phát hành VR-1, một mô hình lập luận được huấn luyện thêm (post-trained) chuyên biệt cho an ninh mạng, thay vì có được khả năng tấn công mạng như một sản phẩm phụ từ sức mạnh lập trình nói chung. VR-1 không phải là mã nguồn mở; nó chỉ được cung cấp cho các tổ chức đã được kiểm duyệt thông qua Chương trình Truy cập Tiên phong Cogent, với các biện pháp bảo vệ, kiểm soát chính sách và ghi nhật ký kiểm toán. Thị trường mục tiêu là các doanh nghiệp lớn (Fortune 2000 trở lên), chính phủ và quốc phòng, đặc biệt là trong các lĩnh vực dịch vụ tài chính, chăm sóc sức khỏe, SaaS, bán lẻ, viễn thông và cơ sở hạ tầng quan trọng. VR-1 điều tra môi trường, kiểm tra giả thuyết và thực hiện các chuỗi tấn công trên đám mây, danh tính, thời gian chạy, mã nguồn, CI/CD, SaaS và bối cảnh tổ chức. Điểm chuẩn đi kèm, IntrusionBench, đánh giá khả năng thực thi, không phải mô tả, đặt các tác nhân vào môi trường được kiểm soát với các bộ xác minh dựa trên thực thi. Cogent đã đánh giá VR-1 trong các bối cảnh hộp đen, hộp xám và hộp trắng; trong hộp trắng, các mô hình hội tụ, cho thấy lợi thế của VR-1 nằm ở việc tìm đường, không phải khai thác. Cogent báo cáo rằng VR-1 chứng minh được số đường tấn công gần như gấp đôi với chi phí khoảng một phần tư (black-box pass@3) so với Kimi K3, Claude Opus 4.8 và GLM-5.2. Cogent sử dụng 'lớp Mythos' (Mythos-class) như một ngưỡng năng lực có phạm vi và không tuyên bố tương đương với các mô hình Mythos của Anthropic; VR-1 không được đánh giá điểm chuẩn so với Mythos. Việc truy cập bị hạn chế, và AI Harness (bộ công cụ AI) không phụ thuộc vào mô hình là thành phần có thể triển khai rộng rãi.
Nguồn: MarkTechPost —
bản gốc
