Opus 5 từ Anthropic: Tập trung vào hiệu quả token, không phải bước nhảy vọt về khả năng
Anthropic
OpenAI
Anthropic đã phát hành Opus 5, phiên bản mới của mô hình. Trọng tâm chính là hiệu quả chi phí: mô hình hoạt động gần như Fable mạnh mẽ hơn nhưng với giá chỉ bằng một nửa. Trên các bài kiểm tra, Opus 5 cho thấy cải thiện dần dần, nhưng tụt hậu trong các tác vụ an ninh mạng do đặc thù huấn luyện.
Anthropic vừa ra mắt Opus 5, bản cập nhật mới nhất cho mô hình vốn nổi tiếng trong mảng lập trình và phát triển. Bản phát hành này không phải là một bước đột phá ngang tầm Opus 4.5 về khả năng viết mã tự động (agentic coding). Theo biểu đồ của Anthropic, Opus 5 đạt kết quả tương đương mô hình Fable trong các tác vụ lập trình và vượt trội hơn Opus 4.8 cùng OpenAI GPT-5.6-Sol ở hầu hết bài kiểm tra, nhưng mức cải thiện hiệu năng chỉ mang tính tăng dần, không đột biến. Lợi thế chính nằm ở chi phí: Opus 5 cung cấp khả năng gần ngang Fable với mức giá chỉ bằng một nửa. Trong khi đó, Anthropic cố tình không huấn luyện Opus 5 trên các tác vụ an ninh mạng nâng cao, khiến mô hình này tụt hậu đáng kể so với Fable và Mythos trong lĩnh vực này. Opus 5 có khả năng phát hiện lỗ hổng ở mức khá, nhưng lại kém xa Mythos 5 trong việc khai thác chúng. Không giống Fable, Opus 5 không có các biện pháp bảo vệ nghiêm ngặt tương tự, chẳng hạn như lưu trữ dữ liệu trong 30 ngày để phân tích sự cố.
Nguồn: Ars Technica —
bản gốc
